> ## Documentation Index
> Fetch the complete documentation index at: https://docs.jiekou.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# ElevenLabs преобразование текста в речь V3

Преобразует текст в речь с использованием выбранного вами голоса и возвращает аудио.

## Заголовки запроса

<ParamField header="Content-Type" type="string" required={true}>
  Перечисляемое значение: `application/json`
</ParamField>

<ParamField header="Authorization" type="string" required={true}>
  Формат аутентификации Bearer: Bearer \{\{API 密钥}}.
</ParamField>

## Тело запроса

<ParamField body="seed" type="integer">
  Если указано, система будет стараться выполнять выборку детерминированно. Повторные запросы с тем же seed и параметрами должны возвращать одинаковый результат, но полная детерминированность не гарантируется.

  Диапазон значений: \[0, 4294967295]
</ParamField>

<ParamField body="text" type="string" required={true}>
  Текст для преобразования в речь.
</ParamField>

<ParamField body="stream" type="boolean">
  Включать ли режим Stream
</ParamField>

<ParamField body="voice_id" type="string" required={true}>
  ID голоса, который нужно использовать.
</ParamField>

<ParamField body="language_code" type="string">
  Код языка (ISO 639-1), используемый для модели и нормализации текста. Если модель не поддерживает этот код языка, будет возвращена ошибка.
</ParamField>

<ParamField body="output_format" type="string" default="mp3_44100_128">
  Выходной формат сгенерированного аудио. Формат: codec\_sample\_rate\_bitrate. Битрейт 192 kbps для MP3 требует аккаунта Creator или выше, частота дискретизации 44.1 kHz для PCM требует аккаунта Pro или выше.

  Допустимые значения: `mp3_22050_32`, `mp3_24000_48`, `mp3_44100_32`, `mp3_44100_64`, `mp3_44100_96`, `mp3_44100_128`, `mp3_44100_192`, `pcm_8000`, `pcm_16000`, `pcm_22050`, `pcm_24000`, `pcm_32000`, `pcm_44100`, `pcm_48000`, `ulaw_8000`, `alaw_8000`, `opus_48000_32`, `opus_48000_64`, `opus_48000_96`, `opus_48000_128`, `opus_48000_192`
</ParamField>

<ParamField body="use_pvc_as_ivc" type="boolean" default={false}>
  Если true, используется IVC-версия голоса вместо PVC-версии. Это временное решение для более высокой задержки PVC-версии.
</ParamField>

<ParamField body="voice_settings" type="object">
  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="speed" type="number" default={1}>
      Регулирует скорость речи. 1.0 — скорость по умолчанию; значение меньше 1.0 замедляет речь, значение больше 1.0 ускоряет речь.
    </ParamField>

    <ParamField body="style" type="number" default={0}>
      Определяет степень выразительности стиля речи. Пытается усилить стиль исходного говорящего. При значении, отличном от 0, расходуется больше вычислительных ресурсов и может увеличиться задержка.
    </ParamField>

    <ParamField body="stability" type="number" default={0.5}>
      Определяет стабильность генерации речи и случайность между отдельными генерациями. Более низкие значения дают более широкий эмоциональный диапазон, более высокие значения могут привести к монотонной речи.
    </ParamField>

    <ParamField body="similarity_boost" type="number" default={0.75}>
      Определяет, насколько точно AI пытается воспроизвести исходный голос.
    </ParamField>

    <ParamField body="use_speaker_boost" type="boolean" default={true}>
      Усиливает сходство с исходным говорящим. Требует немного более высокой вычислительной нагрузки и увеличивает задержку.
    </ParamField>
  </Expandable>
</ParamField>

<ParamField body="apply_text_normalization" type="string" default="auto">
  Управляет нормализацией текста. 'auto' — решение принимает система, 'on' — всегда выполнять нормализацию, 'off' — пропускать.

  Допустимые значения: `auto`, `on`, `off`
</ParamField>

<ParamField body="apply_language_text_normalization" type="boolean" default={false}>
  Управляет языковой нормализацией текста для некоторых поддерживаемых языков, чтобы обеспечить более естественное произношение. Предупреждение: может значительно увеличить задержку. В настоящее время поддерживается только японский.
</ParamField>

<ParamField body="pronunciation_dictionary_locators" type="object[]">
  Список локаторов словарей произношения (id, version\_id), которые нужно применить к тексту. Применяются по порядку. В каждом запросе может быть не более 3 локаторов.

  Длина массива: 0 - 3

  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="version_id" type="string">
      ID версии словаря произношения. Если не указано, используется последняя версия.
    </ParamField>

    <ParamField body="pronunciation_dictionary_id" type="string" required={true}>
      ID словаря произношения.
    </ParamField>
  </Expandable>
</ParamField>

## Информация об ответе

Сгенерированный аудиофайл

Формат: `binary`
