> ## Documentation Index
> Fetch the complete documentation index at: https://docs.jiekou.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Fish Audio S2 Pro テキスト読み上げ

Fish Audio S2 Pro テキスト読み上げモデルは、テキストを自然な音声に変換し、参照音色、サンプリング制御、分割、音声形式、韻律制御をサポートします。

## リクエストヘッダー

<ParamField header="Content-Type" type="string" required={true}>
  列挙値: `application/json`
</ParamField>

<ParamField header="Authorization" type="string" required={true}>
  Bearer 認証形式: Bearer \{\{API Key}}。
</ParamField>

## リクエスト本文

<ParamField body="text" type="string" required={true}>
  音声に変換するテキスト。S2-Pro のマルチスピーカーテキストでは、\<|speaker:0|>你好\<|speaker:1|>你好呀 タグを使用できます。
</ParamField>

<ParamField body="top_p" type="number" default={0.7}>
  nucleus sampling の多様性制御。

  値の範囲：\[0, 1]
</ParamField>

<ParamField body="format" type="string" default="mp3">
  出力音声形式。

  指定可能な値：`wav`, `pcm`, `mp3`, `opus`
</ParamField>

<ParamField body="latency" type="string" default="normal">
  レイテンシーの段階。

  指定可能な値：`low`, `normal`, `balanced`
</ParamField>

<ParamField body="prosody" type="object">
  韻律制御。

  <Expandable title="プロパティ" defaultOpen={true}>
    <ParamField body="speed" type="number" default={1}>
      話速の倍率。
    </ParamField>

    <ParamField body="volume" type="number" default={0}>
      音量調整。
    </ParamField>

    <ParamField body="normalize_loudness" type="boolean" default={true}>
      出力ラウドネスを正規化するかどうか。
    </ParamField>
  </Expandable>
</ParamField>

<ParamField body="normalize" type="boolean" default={true}>
  中国語・英語テキストを正規化します。
</ParamField>

<ParamField body="references" type="object[]">
  ゼロショット音声クローニングに使用する参照音声サンプル。

  <Expandable title="プロパティ" defaultOpen={true}>
    <ParamField body="text" type="string">
      参照音声に対応するテキスト。
    </ParamField>

    <ParamField body="audio" type="string">
      参照音声。プロバイダーのサポートに応じて base64 または URL で渡します。
    </ParamField>
  </Expandable>
</ParamField>

<ParamField body="mp3_bitrate" type="integer" default={128}>
  MP3 ビットレート。単位は kbps。

  指定可能な値：`64`, `128`, `192`
</ParamField>

<ParamField body="sample_rate" type="integer" nullable={true}>
  出力サンプリングレート Hz。空の場合は形式のデフォルト値を使用します。opus は 48000 Hz、それ以外は通常 44100 Hz です。
</ParamField>

<ParamField body="temperature" type="number" default={0.7}>
  表現力の制御。

  値の範囲：\[0, 1]
</ParamField>

<ParamField body="chunk_length" type="integer" default={300}>
  テキスト分割サイズ。

  値の範囲：\[100, 300]
</ParamField>

<ParamField body="opus_bitrate" type="integer" default={-1000}>
  Opus ビットレート。単位は bps。-1000 は自動を表します。

  指定可能な値：`-1000`, `24000`, `32000`, `48000`, `64000`
</ParamField>

<ParamField body="reference_id" type="string">
  音色モデル ID。マルチスピーカーのシーンでは、speaker インデックスに対応する配列を渡すことができます。
</ParamField>

<ParamField body="max_new_tokens" type="integer" default={1024}>
  各分割の最大音声 token 数。
</ParamField>

<ParamField body="min_chunk_length" type="integer" default={50}>
  分割前の最小文字数。

  値の範囲：\[0, 100]
</ParamField>

<ParamField body="repetition_penalty" type="number" default={1.2}>
  音声パターンの繰り返しを低減するペナルティ係数。
</ParamField>

<ParamField body="early_stop_threshold" type="number" default={1}>
  早期停止しきい値。

  値の範囲：\[0, 1]
</ParamField>

<ParamField body="condition_on_previous_chunks" type="boolean" default={true}>
  前の音声分割をコンテキストとして使用します。
</ParamField>

## レスポンス情報

生成された音声。

形式: `binary`
