> ## Documentation Index
> Fetch the complete documentation index at: https://docs.jiekou.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# ElevenLabs Texto para fala Multilingual V2

Converta texto em fala usando a voz de sua escolha e retorne o áudio.

## Cabeçalhos da solicitação

<ParamField header="Content-Type" type="string" required={true}>
  Valores enumerados: `application/json`
</ParamField>

<ParamField header="Authorization" type="string" required={true}>
  Formato de autenticação Bearer: Bearer \{\{API Key}}.
</ParamField>

## Corpo da solicitação

<ParamField body="seed" type="integer">
  Se especificado, o sistema tentará amostrar de forma determinística. Solicitações repetidas com o mesmo seed e os mesmos parâmetros devem retornar o mesmo resultado, mas a determinação completa não é garantida.

  Intervalo de valores: \[0, 4294967295]
</ParamField>

<ParamField body="text" type="string" required={true}>
  O texto a ser convertido em fala.
</ParamField>

<ParamField body="voice_id" type="string" required={true}>
  O ID da voz a ser usada.
</ParamField>

<ParamField body="next_text" type="string">
  O texto após o texto da solicitação atual. Usado para melhorar a coerência da fala ao concatenar várias gerações.
</ParamField>

<ParamField body="language_code" type="string">
  Código de idioma (ISO 639-1) usado para o modelo e a normalização de texto. Se o modelo não oferecer suporte a este código de idioma, será retornado um erro.
</ParamField>

<ParamField body="output_format" type="string" default="mp3_44100_128">
  O formato de saída do áudio gerado. O formato é codec\_sample\_rate\_bitrate. A taxa de bits de 192 kbps para MP3 requer uma conta Creator ou superior, e a taxa de amostragem de 44,1 kHz para PCM requer uma conta Pro ou superior.

  Valores opcionais: `mp3_22050_32`, `mp3_24000_48`, `mp3_44100_32`, `mp3_44100_64`, `mp3_44100_96`, `mp3_44100_128`, `mp3_44100_192`, `pcm_8000`, `pcm_16000`, `pcm_22050`, `pcm_24000`, `pcm_32000`, `pcm_44100`, `pcm_48000`, `ulaw_8000`, `alaw_8000`, `opus_48000_32`, `opus_48000_64`, `opus_48000_96`, `opus_48000_128`, `opus_48000_192`
</ParamField>

<ParamField body="previous_text" type="string">
  O texto antes do texto da solicitação atual. Usado para melhorar a coerência da fala ao concatenar várias gerações.
</ParamField>

<ParamField body="use_pvc_as_ivc" type="boolean" default={false}>
  Se true, usa a versão IVC da voz em vez da versão PVC. Esta é uma solução temporária para a latência mais alta da versão PVC.
</ParamField>

<ParamField body="voice_settings" type="object">
  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="speed" type="number" default={1}>
      Ajusta a velocidade da fala. 1.0 é a velocidade padrão; valores menores que 1.0 diminuem a velocidade da fala, e valores maiores que 1.0 aumentam a velocidade.
    </ParamField>

    <ParamField body="style" type="number" default={0}>
      Determina o grau de exagero do estilo da fala. Tenta amplificar o estilo do falante original. Quando definido como um valor diferente de 0, consome mais recursos computacionais e pode aumentar a latência.
    </ParamField>

    <ParamField body="stability" type="number" default={0.5}>
      Determina a estabilidade da geração de fala e a aleatoriedade entre cada geração. Valores mais baixos proporcionam uma faixa emocional mais ampla; valores mais altos podem resultar em fala monótona.
    </ParamField>

    <ParamField body="similarity_boost" type="number" default={0.75}>
      Determina o quão próximo a IA tenta ficar da voz original ao reproduzi-la.
    </ParamField>

    <ParamField body="use_speaker_boost" type="boolean" default={true}>
      Aumenta a semelhança com o falante original. Requer uma carga computacional ligeiramente maior e aumenta a latência.
    </ParamField>
  </Expandable>
</ParamField>

<ParamField body="next_request_ids" type="string[]">
  Lista de request\_id das amostras subsequentes. Usada para manter a coerência da fala ao regenerar amostras. É possível enviar no máximo 3 request\_id.

  Comprimento do array: 0 - 3
</ParamField>

<ParamField body="previous_request_ids" type="string[]">
  Lista de request\_id das amostras geradas antes da geração atual. Pode ser usada para melhorar a coerência da fala. É possível enviar no máximo 3 request\_id.

  Comprimento do array: 0 - 3
</ParamField>

<ParamField body="apply_text_normalization" type="string" default="auto">
  Controla a normalização de texto. 'auto' deixa o sistema decidir, 'on' sempre normaliza, e 'off' ignora a normalização.

  Valores opcionais: `auto`, `on`, `off`
</ParamField>

<ParamField body="apply_language_text_normalization" type="boolean" default={false}>
  Controla a normalização de texto específica de idioma para alguns idiomas compatíveis, a fim de obter uma pronúncia mais natural. Aviso: isso pode aumentar significativamente a latência. Atualmente, há suporte apenas para japonês.
</ParamField>

<ParamField body="pronunciation_dictionary_locators" type="object[]">
  Lista de localizadores de dicionário de pronúncia (id, version\_id) que devem ser aplicados ao texto. Eles são aplicados em ordem. Cada solicitação pode ter no máximo 3 localizadores.

  Comprimento do array: 0 - 3

  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="version_id" type="string">
      O ID da versão do dicionário de pronúncia. Se não for especificado, a versão mais recente será usada.
    </ParamField>

    <ParamField body="pronunciation_dictionary_id" type="string" required={true}>
      O ID do dicionário de pronúncia.
    </ParamField>
  </Expandable>
</ParamField>

## Informações da resposta

Arquivo de áudio gerado

Formato: `binary`
