> ## Documentation Index
> Fetch the complete documentation index at: https://docs.jiekou.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# ElevenLabs Преобразование текста в речь Flash V2.5

Преобразует текст в речь с использованием выбранного вами голоса и возвращает аудио.

## Заголовки запроса

<ParamField header="Content-Type" type="string" required={true}>
  Перечисляемое значение: `application/json`
</ParamField>

<ParamField header="Authorization" type="string" required={true}>
  Формат аутентификации Bearer: Bearer \{\{API 密钥}}.
</ParamField>

## Тело запроса

<ParamField body="seed" type="integer">
  Если указано, система будет стараться выполнять детерминированную выборку. Повторные запросы с одинаковыми seed и параметрами должны возвращать одинаковый результат, но полная детерминированность не гарантируется.

  Диапазон значений: \[0, 4294967295]
</ParamField>

<ParamField body="text" type="string" required={true}>
  Текст для преобразования в речь.
</ParamField>

<ParamField body="stream" type="boolean">
  Включить ли режим Stream
</ParamField>

<ParamField body="voice_id" type="string" required={true}>
  ID голоса, который нужно использовать.
</ParamField>

<ParamField body="next_text" type="string">
  Текст после текста текущего запроса. Используется для улучшения связности речи при объединении нескольких генераций.
</ParamField>

<ParamField body="language_code" type="string">
  Код языка (ISO 639-1), используемый для модели и нормализации текста. Если модель не поддерживает этот код языка, будет возвращена ошибка.
</ParamField>

<ParamField body="output_format" type="string" default="mp3_44100_128">
  Формат вывода сгенерированного аудио. Формат: codec\_sample\_rate\_bitrate. Битрейт MP3 192 кбит/с требует учетной записи Creator или выше, частота дискретизации PCM 44,1 кГц требует учетной записи Pro или выше.

  Допустимые значения: `mp3_22050_32`, `mp3_24000_48`, `mp3_44100_32`, `mp3_44100_64`, `mp3_44100_96`, `mp3_44100_128`, `mp3_44100_192`, `pcm_8000`, `pcm_16000`, `pcm_22050`, `pcm_24000`, `pcm_32000`, `pcm_44100`, `pcm_48000`, `ulaw_8000`, `alaw_8000`, `opus_48000_32`, `opus_48000_64`, `opus_48000_96`, `opus_48000_128`, `opus_48000_192`
</ParamField>

<ParamField body="previous_text" type="string">
  Текст перед текстом текущего запроса. Используется для улучшения связности речи при объединении нескольких генераций.
</ParamField>

<ParamField body="use_pvc_as_ivc" type="boolean" default={false}>
  Если true, используется IVC-версия голоса вместо PVC-версии. Это временное решение для более высокой задержки PVC-версии.
</ParamField>

<ParamField body="voice_settings" type="object">
  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="speed" type="number" default={1}>
      Регулирует скорость речи. 1.0 — скорость по умолчанию; значение меньше 1.0 замедляет речь, а больше 1.0 ускоряет речь.
    </ParamField>

    <ParamField body="style" type="number" default={0}>
      Определяет степень выразительности стиля речи. Пытается усилить стиль исходного говорящего. При установке ненулевого значения потребляет больше вычислительных ресурсов и может увеличить задержку.
    </ParamField>

    <ParamField body="stability" type="number" default={0.5}>
      Определяет стабильность генерации речи и случайность между генерациями. Более низкие значения дают более широкий эмоциональный диапазон, более высокие значения могут привести к монотонной речи.
    </ParamField>

    <ParamField body="similarity_boost" type="number" default={0.75}>
      Определяет, насколько точно AI пытается воспроизвести исходный голос.
    </ParamField>

    <ParamField body="use_speaker_boost" type="boolean" default={true}>
      Усиливает сходство с исходным говорящим. Требует немного большей вычислительной нагрузки и увеличивает задержку.
    </ParamField>
  </Expandable>
</ParamField>

<ParamField body="next_request_ids" type="string[]">
  Список request\_id последующих образцов. Используется для сохранения связности речи при повторной генерации образцов. Можно передать не более 3 request\_id.

  Длина массива: 0 - 3
</ParamField>

<ParamField body="previous_request_ids" type="string[]">
  Список request\_id образцов, уже сгенерированных перед текущей генерацией. Может использоваться для улучшения связности речи. Можно передать не более 3 request\_id.

  Длина массива: 0 - 3
</ParamField>

<ParamField body="apply_text_normalization" type="string" default="auto">
  Управляет нормализацией текста. 'auto' — определяется системой, 'on' — всегда нормализовать, 'off' — пропустить.

  Допустимые значения: `auto`, `on`, `off`
</ParamField>

<ParamField body="apply_language_text_normalization" type="boolean" default={false}>
  Управляет языковой нормализацией текста для некоторых поддерживаемых языков, чтобы обеспечить более естественное произношение. Предупреждение: может значительно увеличить задержку. В настоящее время поддерживается только японский язык.
</ParamField>

<ParamField body="pronunciation_dictionary_locators" type="object[]">
  Список локаторов словарей произношения (id, version\_id), которые нужно применить к тексту. Применяются по порядку. В каждом запросе может быть не более 3 локаторов.

  Длина массива: 0 - 3

  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="version_id" type="string">
      ID версии словаря произношения. Если не указан, используется последняя версия.
    </ParamField>

    <ParamField body="pronunciation_dictionary_id" type="string" required={true}>
      ID словаря произношения.
    </ParamField>
  </Expandable>
</ParamField>

## Информация об ответе

Сгенерированный аудиофайл

Формат: `binary`
