Skip to main content
POST
MiniMax Speech 2.8 Turbo: синхронный синтез речи
Преобразует текст в речь и поддерживает различные голоса, управление эмоциями, настройку скорости речи и другие функции. Ограничение длины текста — менее 10000 символов. Если длина текста превышает 3000 символов, рекомендуется использовать потоковый вывод.

Заголовки запроса

string
обязательно
Перечисляемое значение: application/json
string
обязательно
Формат Bearer-аутентификации: Bearer {{API 密钥}}.

Тело запроса

string
обязательно
Текст, который необходимо синтезировать в речь. Ограничение длины — менее 10000 символов. Если длина текста превышает 3000 символов, рекомендуется использовать потоковый вывод. Поддерживает переключение абзацев (символы новой строки), управление паузами (метки <#x#>), теги междометий/звуковых реакций (например, (laughs), (coughs) и т. д.; поддерживается только speech-2.8-hd/turbo)
boolean
по умолчанию:false
Управляет тем, будет ли вывод потоковым. По умолчанию false, то есть потоковый вывод не включен
object
object
string
по умолчанию:"hex"
Параметр, управляющий формой результата вывода. Возможные значения: url, hex; значение по умолчанию — hex. Этот параметр действует только в непотоковом сценарии; в потоковом сценарии поддерживается возврат только в форме hex. Возвращаемый url действителен 24 часаВозможные значения: url, hex
object
boolean
по умолчанию:false
Управляет добавлением ритмического аудиоидентификатора в конец синтезированного аудио. Значение по умолчанию — false. Этот параметр действует только для непотокового синтеза
string
Усиливать ли способность распознавания указанных малораспространенных языков и диалектов. Значение по умолчанию — null; можно установить auto, чтобы модель определяла это самостоятельноВозможные значения: Chinese, Chinese,Yue, English, Arabic, Russian, Spanish, French, Portuguese, German, Turkish, Dutch, Ukrainian, Vietnamese, Indonesian, Japanese, Italian, Korean, Thai, Polish, Romanian, Greek, Czech, Finnish, Hindi, Bulgarian, Danish, Hebrew, Malay, Persian, Slovak, Swedish, Croatian, Filipino, Hungarian, Norwegian, Slovenian, Catalan, Nynorsk, Tamil, Afrikaans, auto
object
object[]
Настройки смешанного голоса; поддерживается смешивание максимум 4 голосов
boolean
по умолчанию:false
Управляет включением службы субтитров. Значение по умолчанию — false. Этот параметр действует только в сценарии непотокового вывода и только для моделей speech-2.6-hd, speech-2.6-turbo, speech-01-turbo, speech-01-hd
boolean
по умолчанию:false
Включите этот параметр, чтобы стыки между фразами звучали более естественно. Поддерживаются только модели speech-2.8-hd и speech-2.8-turbo
object

Информация ответа

object
Возвращаемый объект синтезированных данных; может быть null, поэтому требуется проверка на непустое значение
string
id текущей сессии, используемый для помощи в локализации проблемы при обращении за консультацией или отправке отзыва
object
Код состояния и сведения о текущем запросе
object
Дополнительная информация об аудио