> ## Documentation Index
> Fetch the complete documentation index at: https://docs.jiekou.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# ElevenLabs テキスト読み上げ Multilingual V2

選択した音声を使用してテキストを音声に変換し、音声を返します。

## リクエストヘッダー

<ParamField header="Content-Type" type="string" required={true}>
  列挙値: `application/json`
</ParamField>

<ParamField header="Authorization" type="string" required={true}>
  Bearer 認証形式: Bearer \{\{API Key}}。
</ParamField>

## リクエストボディ

<ParamField body="seed" type="integer">
  指定された場合、システムは可能な限り決定論的にサンプリングします。同じseedおよびパラメーターでリクエストを繰り返すと同じ結果が返されるはずですが、完全な決定性は保証されません。

  値の範囲：\[0, 4294967295]
</ParamField>

<ParamField body="text" type="string" required={true}>
  音声に変換するテキスト。
</ParamField>

<ParamField body="voice_id" type="string" required={true}>
  使用する音声ID。
</ParamField>

<ParamField body="next_text" type="string">
  現在のリクエストテキストの後に続くテキスト。複数回の生成を結合する際に音声の一貫性を改善するために使用されます。
</ParamField>

<ParamField body="language_code" type="string">
  モデルおよびテキスト正規化に使用する言語コード（ISO 639-1）。モデルがこの言語コードをサポートしていない場合、エラーが返されます。
</ParamField>

<ParamField body="output_format" type="string" default="mp3_44100_128">
  生成される音声の出力形式。形式は codec\_sample\_rate\_bitrate です。MP3の192kbpsビットレートにはCreator以上のアカウントが必要で、PCMの44.1kHzサンプリングレートにはPro以上のアカウントが必要です。

  使用可能な値：`mp3_22050_32`, `mp3_24000_48`, `mp3_44100_32`, `mp3_44100_64`, `mp3_44100_96`, `mp3_44100_128`, `mp3_44100_192`, `pcm_8000`, `pcm_16000`, `pcm_22050`, `pcm_24000`, `pcm_32000`, `pcm_44100`, `pcm_48000`, `ulaw_8000`, `alaw_8000`, `opus_48000_32`, `opus_48000_64`, `opus_48000_96`, `opus_48000_128`, `opus_48000_192`
</ParamField>

<ParamField body="previous_text" type="string">
  現在のリクエストテキストの前にあるテキスト。複数回の生成を結合する際に音声の一貫性を改善するために使用されます。
</ParamField>

<ParamField body="use_pvc_as_ivc" type="boolean" default={false}>
  true の場合、PVCバージョンではなくIVCバージョンの音声を使用します。これはPVCバージョンの高いレイテンシに対する一時的な対策です。
</ParamField>

<ParamField body="voice_settings" type="object">
  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="speed" type="number" default={1}>
      音声の速度を調整します。1.0がデフォルト速度で、1.0未満では話速が遅くなり、1.0より大きいと話速が速くなります。
    </ParamField>

    <ParamField body="style" type="number" default={0}>
      音声スタイルの誇張度を決定します。元の話者のスタイルを強調しようとします。0以外に設定すると、より多くの計算リソースを消費し、レイテンシが増加する可能性があります。
    </ParamField>

    <ParamField body="stability" type="number" default={0.5}>
      音声生成の安定性と、各生成間のランダム性を決定します。低い値ではより幅広い感情表現が得られ、高い値では音声が単調になる可能性があります。
    </ParamField>

    <ParamField body="similarity_boost" type="number" default={0.75}>
      AI が元の音声を再現しようとする際の一致度を決定します。
    </ParamField>

    <ParamField body="use_speaker_boost" type="boolean" default={true}>
      元の話者との類似性を強化します。やや高い計算負荷が必要となり、レイテンシが増加します。
    </ParamField>
  </Expandable>
</ParamField>

<ParamField body="next_request_ids" type="string[]">
  後続サンプルのrequest\_idリスト。サンプルを再生成する際に音声の一貫性を保つために使用されます。最大3つのrequest\_idを渡せます。

  配列長：0 - 3
</ParamField>

<ParamField body="previous_request_ids" type="string[]">
  現在の生成より前に生成済みのサンプルのrequest\_idリスト。音声の一貫性を改善するために使用できます。最大3つのrequest\_idを渡せます。

  配列長：0 - 3
</ParamField>

<ParamField body="apply_text_normalization" type="string" default="auto">
  テキスト正規化を制御します。'auto' はシステムが決定し、'on' は常に正規化し、'off' はスキップします。

  使用可能な値：`auto`, `on`, `off`
</ParamField>

<ParamField body="apply_language_text_normalization" type="boolean" default={false}>
  より自然な発音を実現するため、特定の対応言語に対する言語テキスト正規化を制御します。警告：レイテンシが大幅に増加する可能性があります。現在は日本語のみ対応しています。
</ParamField>

<ParamField body="pronunciation_dictionary_locators" type="object[]">
  テキストに適用する発音辞書ロケーター（id, version\_id）のリスト。順番に適用されます。リクエストごとに最大3つのロケーターを指定できます。

  配列長：0 - 3

  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="version_id" type="string">
      発音辞書バージョンのID。指定しない場合は最新バージョンが使用されます。
    </ParamField>

    <ParamField body="pronunciation_dictionary_id" type="string" required={true}>
      発音辞書のID。
    </ParamField>
  </Expandable>
</ParamField>

## レスポンス情報

生成された音声ファイル

形式: `binary`
