> ## Documentation Index
> Fetch the complete documentation index at: https://docs.jiekou.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# ElevenLabs テキスト読み上げ Turbo v2

選択した音声を使用してテキストを音声に変換し、音声を返します。

## リクエストヘッダー

<ParamField header="Content-Type" type="string" required={true}>
  列挙値: `application/json`
</ParamField>

<ParamField header="Authorization" type="string" required={true}>
  Bearer 認証フォーマット: Bearer \{\{API Key}}。
</ParamField>

## リクエストボディ

<ParamField body="seed" type="integer">
  指定した場合、システムは可能な限り決定論的にサンプリングします。同じseedおよびパラメータでの繰り返しリクエストは同じ結果を返すはずですが、完全な決定性は保証されません。

  値の範囲：\[0, 4294967295]
</ParamField>

<ParamField body="text" type="string" required={true}>
  音声に変換するテキスト。
</ParamField>

<ParamField body="voice_id" type="string" required={true}>
  使用する音声ID。
</ParamField>

<ParamField body="next_text" type="string">
  現在のリクエストテキストの後に続くテキスト。複数回の生成を連結する際に音声の一貫性を改善するために使用します。
</ParamField>

<ParamField body="language_code" type="string">
  モデルおよびテキスト正規化に使用する言語コード（ISO 639-1）。モデルがこの言語コードをサポートしていない場合、エラーが返されます。
</ParamField>

<ParamField body="output_format" type="string" default="mp3_44100_128">
  生成音声の出力形式。形式は codec\_sample\_rate\_bitrate です。MP3 の 192kbps ビットレートには Creator 以上のアカウントが必要で、PCM の 44.1kHz サンプリングレートには Pro 以上のアカウントが必要です。

  指定可能な値：`mp3_22050_32`, `mp3_24000_48`, `mp3_44100_32`, `mp3_44100_64`, `mp3_44100_96`, `mp3_44100_128`, `mp3_44100_192`, `pcm_8000`, `pcm_16000`, `pcm_22050`, `pcm_24000`, `pcm_32000`, `pcm_44100`, `pcm_48000`, `ulaw_8000`, `alaw_8000`, `opus_48000_32`, `opus_48000_64`, `opus_48000_96`, `opus_48000_128`, `opus_48000_192`
</ParamField>

<ParamField body="previous_text" type="string">
  現在のリクエストテキストの前にあるテキスト。複数回の生成を連結する際に音声の一貫性を改善するために使用します。
</ParamField>

<ParamField body="use_pvc_as_ivc" type="boolean" default={false}>
  true の場合、PVC バージョンではなく IVC バージョンの音声を使用します。これは PVC バージョンの高いレイテンシに対する一時的な対応策です。
</ParamField>

<ParamField body="voice_settings" type="object">
  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="speed" type="number" default={1}>
      音声の速度を調整します。1.0 がデフォルト速度で、1.0 未満にすると話速が遅くなり、1.0 より大きいと話速が速くなります。
    </ParamField>

    <ParamField body="style" type="number" default={0}>
      音声スタイルの誇張の度合いを決定します。元の話者のスタイルを強調しようとします。0 以外に設定すると、より多くの計算リソースを消費し、レイテンシが増加する可能性があります。
    </ParamField>

    <ParamField body="stability" type="number" default={0.5}>
      音声生成の安定性と、各生成間のランダム性を決定します。低い値ではより幅広い感情表現が得られ、高い値では音声が単調になる可能性があります。
    </ParamField>

    <ParamField body="similarity_boost" type="number" default={0.75}>
      AI が元の音声を再現しようとする際の一致度を決定します。
    </ParamField>

    <ParamField body="use_speaker_boost" type="boolean" default={true}>
      元の話者との類似度を高めます。やや高い計算負荷が必要になり、レイテンシが増加します。
    </ParamField>
  </Expandable>
</ParamField>

<ParamField body="next_request_ids" type="string[]">
  後続サンプルのrequest\_idリスト。サンプルを再生成する際に音声の一貫性を維持するために使用します。最大 3 個のrequest\_idを渡せます。

  配列の長さ：0 - 3
</ParamField>

<ParamField body="previous_request_ids" type="string[]">
  現在の生成の前に生成済みのサンプルのrequest\_idリスト。音声の一貫性を改善するために使用できます。最大 3 個のrequest\_idを渡せます。

  配列の長さ：0 - 3
</ParamField>

<ParamField body="apply_text_normalization" type="string" default="auto">
  テキスト正規化を制御します。'auto' はシステムが判断し、'on' は常に正規化を行い、'off' はスキップします。

  指定可能な値：`auto`, `on`, `off`
</ParamField>

<ParamField body="apply_language_text_normalization" type="boolean" default={false}>
  一部の対応言語に対して、より自然な発音を実現するための言語テキスト正規化を制御します。警告：レイテンシが大幅に増加する可能性があります。現在は日本語のみ対応しています。
</ParamField>

<ParamField body="pronunciation_dictionary_locators" type="object[]">
  テキストに適用する発音辞書ロケーター（id, version\_id）のリスト。順番に適用されます。各リクエストにつき最大 3 個のロケーターを指定できます。

  配列の長さ：0 - 3

  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="version_id" type="string">
      発音辞書バージョンのID。指定しない場合は最新バージョンが使用されます。
    </ParamField>

    <ParamField body="pronunciation_dictionary_id" type="string" required={true}>
      発音辞書のID。
    </ParamField>
  </Expandable>
</ParamField>

## レスポンス情報

生成された音声ファイル

形式: `binary`
