> ## Documentation Index
> Fetch the complete documentation index at: https://docs.jiekou.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Fish Audio S2 Pro Texto para fala

O modelo de texto para fala Fish Audio S2 Pro converte texto em fala natural, com suporte a controle de amostragem, segmentação, formatos de áudio e controle de prosódia.

## Cabeçalhos da solicitação

<ParamField header="Content-Type" type="string" required={true}>
  Valores enumerados: `application/json`
</ParamField>

<ParamField header="Authorization" type="string" required={true}>
  Formato de autenticação Bearer: Bearer \{\{chave de API}}.
</ParamField>

## Corpo da solicitação

<ParamField body="text" type="string" required={true}>
  O texto que precisa ser convertido em fala. Para texto com múltiplos locutores no S2-Pro, é possível usar tags como \<|speaker:0|>Olá\<|speaker:1|>Oi.
</ParamField>

<ParamField body="top_p" type="number" default={0.7}>
  Controle de diversidade da amostragem por núcleo.

  Intervalo de valores: \[0, 1]
</ParamField>

<ParamField body="format" type="string" default="mp3">
  Formato de áudio de saída.

  Valores opcionais: `wav`, `pcm`, `mp3`, `opus`
</ParamField>

<ParamField body="latency" type="string" default="normal">
  Nível de latência.

  Valores opcionais: `low`, `normal`, `balanced`
</ParamField>

<ParamField body="prosody" type="object">
  Controle de prosódia.

  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="speed" type="number" default={1}>
      Multiplicador da velocidade da fala.
    </ParamField>

    <ParamField body="volume" type="number" default={0}>
      Ajuste de volume.
    </ParamField>

    <ParamField body="normalize_loudness" type="boolean" default={true}>
      Indica se o volume percebido da saída deve ser normalizado.
    </ParamField>
  </Expandable>
</ParamField>

<ParamField body="normalize" type="boolean" default={true}>
  Normaliza textos em chinês e inglês.
</ParamField>

<ParamField body="mp3_bitrate" type="integer" default={128}>
  Taxa de bits de MP3, em kbps.

  Valores opcionais: `64`, `128`, `192`
</ParamField>

<ParamField body="sample_rate" type="integer" nullable={true}>
  Taxa de amostragem de saída em Hz. Se estiver vazia, usa o valor padrão do formato; para opus é 48000 Hz, e para outros geralmente é 44100 Hz.
</ParamField>

<ParamField body="temperature" type="number" default={0.7}>
  Controle de expressividade.

  Intervalo de valores: \[0, 1]
</ParamField>

<ParamField body="chunk_length" type="integer" default={300}>
  Tamanho dos segmentos de texto.

  Intervalo de valores: \[100, 300]
</ParamField>

<ParamField body="opus_bitrate" type="integer" default={-1000}>
  Taxa de bits de Opus, em bps; -1000 indica automático.

  Valores opcionais: `-1000`, `24000`, `32000`, `48000`, `64000`
</ParamField>

<ParamField body="reference_id" type="string">
  ID do modelo de timbre; em cenários com múltiplos locutores, é possível passar um array correspondente aos índices de speaker.
</ParamField>

<ParamField body="max_new_tokens" type="integer" default={1024}>
  Número máximo de tokens de áudio por segmento.
</ParamField>

<ParamField body="min_chunk_length" type="integer" default={50}>
  Número mínimo de caracteres antes da segmentação.

  Intervalo de valores: \[0, 100]
</ParamField>

<ParamField body="repetition_penalty" type="number" default={1.2}>
  Coeficiente de penalidade para reduzir repetições no padrão de áudio.
</ParamField>

<ParamField body="early_stop_threshold" type="number" default={1}>
  Limiar de parada antecipada.

  Intervalo de valores: \[0, 1]
</ParamField>

<ParamField body="condition_on_previous_chunks" type="boolean" default={true}>
  Usa os segmentos de áudio anteriores como contexto.
</ParamField>

## Informações da resposta

Áudio gerado.

Formato: `binary`
