> ## Documentation Index
> Fetch the complete documentation index at: https://docs.jiekou.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Быстрое клонирование аудио MiniMax

Этот интерфейс поддерживает клонирование голоса в моно- и стереорежиме, а также быстрое создание речи с тем же тембром на основе указанного аудиофайла.
Тембр, быстро клонированный этим интерфейсом, является временным. Если вы хотите сохранить определенный клонированный тембр навсегда, вызовите этот тембр в любом интерфейсе синтеза речи T2A в течение 168 часов (7 дней) (прослушивание внутри данного интерфейса не учитывается); в противном случае этот тембр будет удален.

Сценарии применения этого интерфейса: клонирование IP, клонирование тембра и другие сценарии, где требуется быстро воспроизвести определенный тембр.

Примечания:

* Формат загружаемого аудиофайла должен быть: mp3, m4a, wav;
* Длительность загружаемого аудиофайла должна быть не менее 10 секунд и не более 5 минут;
* Размер загружаемого аудиофайла не должен превышать 20mb.

## Заголовки запроса

<ParamField header="Content-Type" type="string" required={true}>
  Перечисляемое значение: `application/json`
</ParamField>

<ParamField header="Authorization" type="string" required={true}>
  Формат Bearer-аутентификации: Bearer \{\{API-ключ}}.
</ParamField>

## Тело запроса

<ParamField body="audio_url" type="string" required={true}>
  URL аудиофайла, тембр которого нужно клонировать. Поддерживаются форматы mp3, m4a, wav.
</ParamField>

<ParamField body="clone_prompt">
  Параметры клонирования тембра. Передача этого параметра поможет повысить сходство тембра и стабильность синтеза речи.

  При использовании этого параметра необходимо одновременно загрузить небольшой пример аудио (длительностью менее 8s) и соответствующий ему текст; аудио поддерживает форматы mp3, m4a, wav.

  <Expandable title="properties">
    <ParamField body="prompt_audio_url" type="number" required={true}>
      Параметр аудио prompt: URL примера аудио, длительность должна быть меньше 8s.
    </ParamField>

    <ParamField body="prompt_text" type="string" required={true}>
      Параметр аудио prompt: укажите соответствующий текст для примера аудио. Необходимо убедиться, что он совпадает с содержанием аудио; в конце предложения должен быть знак препинания.
    </ParamField>
  </Expandable>
</ParamField>

<ParamField body="text" type="string">
  Параметр пробного прослушивания клонирования. Модель произнесет данный текст с клонированным тембром и вернет результат синтеза аудио в виде ссылки для прослушивания эффекта клонирования. Ограничение — до 2000 символов. Примечание: за пробное прослушивание будет взиматься стандартная плата за синтез речи в зависимости от количества символов; тарифы соответствуют интерфейсам T2A.
</ParamField>

<ParamField body="model" type="string">
  Параметр пробного прослушивания клонирования. Задает голосовую модель, используемую для прослушивания; при передаче поля "text" это поле обязательно.<br />
  Доступные варианты: `speech-2.8-hd`, `speech-2.8-turbo`
</ParamField>

<ParamField body="accuracy" type="float">
  Параметр клонирования аудио. Диапазон значений: \[0,1]. При передаче этого поля будет установлен порог точности проверки текста; если поле не передано, значение по умолчанию — 0.7.
</ParamField>

<ParamField body="need_noise_reduction" type="bool">
  Параметр клонирования аудио. Включать ли шумоподавление. Если не передано, по умолчанию используется false.
</ParamField>

<ParamField body="need_volume_normalization" type="bool">
  Параметр клонирования аудио. Включать ли нормализацию громкости. Если не передано, по умолчанию используется false.
</ParamField>

## Информация об ответе

<ResponseField name="demo_audio_url" type="string">
  Если в теле запроса переданы текст для пробного прослушивания text и модель для пробного прослушивания model, этот параметр вернет пробное аудио в виде ссылки.
</ResponseField>

<ResponseField name="voice_id" type="string">
  Сгенерированный voice\_id
</ResponseField>
