> ## Documentation Index
> Fetch the complete documentation index at: https://docs.jiekou.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# ElevenLabs テキスト読み上げ V3

選択した音声でテキストを音声に変換し、音声データを返します。

## リクエストヘッダー

<ParamField header="Content-Type" type="string" required={true}>
  列挙値: `application/json`
</ParamField>

<ParamField header="Authorization" type="string" required={true}>
  Bearer 認証形式: Bearer \{\{API Key}}。
</ParamField>

## リクエストボディ

<ParamField body="seed" type="integer">
  指定した場合、システムは可能な限り決定論的にサンプリングします。同じseedおよびパラメータでリクエストを繰り返すと同じ結果が返るはずですが、完全な決定性は保証されません。

  値の範囲：\[0, 4294967295]
</ParamField>

<ParamField body="text" type="string" required={true}>
  音声に変換するテキスト。
</ParamField>

<ParamField body="stream" type="boolean">
  Stream モードを有効にするかどうか
</ParamField>

<ParamField body="voice_id" type="string" required={true}>
  使用する音声ID。
</ParamField>

<ParamField body="language_code" type="string">
  モデルおよびテキスト正規化に使用する言語コード（ISO 639-1）。モデルがこの言語コードをサポートしていない場合、エラーが返されます。
</ParamField>

<ParamField body="output_format" type="string" default="mp3_44100_128">
  生成される音声の出力形式。形式は codec\_sample\_rate\_bitrate です。MP3の192kbpsビットレートにはCreator以上のアカウントが必要で、PCMの44.1kHzサンプリングレートにはPro以上のアカウントが必要です。

  使用可能な値：`mp3_22050_32`, `mp3_24000_48`, `mp3_44100_32`, `mp3_44100_64`, `mp3_44100_96`, `mp3_44100_128`, `mp3_44100_192`, `pcm_8000`, `pcm_16000`, `pcm_22050`, `pcm_24000`, `pcm_32000`, `pcm_44100`, `pcm_48000`, `ulaw_8000`, `alaw_8000`, `opus_48000_32`, `opus_48000_64`, `opus_48000_96`, `opus_48000_128`, `opus_48000_192`
</ParamField>

<ParamField body="use_pvc_as_ivc" type="boolean" default={false}>
  true の場合、PVCバージョンではなくIVCバージョンの音声を使用します。これはPVCバージョンの高いレイテンシに対する一時的な対策です。
</ParamField>

<ParamField body="voice_settings" type="object">
  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="speed" type="number" default={1}>
      音声の速度を調整します。1.0がデフォルト速度で、1.0未満では話速が遅くなり、1.0を超えると話速が速くなります。
    </ParamField>

    <ParamField body="style" type="number" default={0}>
      音声スタイルの誇張の度合いを決定します。元の話者のスタイルを強調しようとします。0以外に設定すると、より多くの計算リソースを消費し、レイテンシが増加する可能性があります。
    </ParamField>

    <ParamField body="stability" type="number" default={0.5}>
      音声生成の安定性と、各生成間のランダム性を決定します。低い値ではより広い感情表現が得られ、高い値では音声が単調になる可能性があります。
    </ParamField>

    <ParamField body="similarity_boost" type="number" default={0.75}>
      AI が元の音声を再現しようとする際の一致度を決定します。
    </ParamField>

    <ParamField body="use_speaker_boost" type="boolean" default={true}>
      元の話者との類似度を強化します。やや高い計算負荷が必要で、レイテンシが増加します。
    </ParamField>
  </Expandable>
</ParamField>

<ParamField body="apply_text_normalization" type="string" default="auto">
  テキスト正規化を制御します。'auto' はシステムが判断し、'on' は常に正規化し、'off' はスキップします。

  使用可能な値：`auto`, `on`, `off`
</ParamField>

<ParamField body="apply_language_text_normalization" type="boolean" default={false}>
  一部の対応言語に対して、より自然な発音を実現するための言語テキスト正規化を制御します。警告：レイテンシが大幅に増加する可能性があります。現在は日本語のみ対応しています。
</ParamField>

<ParamField body="pronunciation_dictionary_locators" type="object[]">
  テキストに適用する発音辞書ロケーター（id, version\_id）のリスト。順番に適用されます。各リクエストにつき最大3つのロケーターを指定できます。

  配列の長さ：0 - 3

  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="version_id" type="string">
      発音辞書バージョンのID。指定しない場合は、最新バージョンが使用されます。
    </ParamField>

    <ParamField body="pronunciation_dictionary_id" type="string" required={true}>
      発音辞書のID。
    </ParamField>
  </Expandable>
</ParamField>

## レスポンス情報

生成された音声ファイル

形式: `binary`
