Skip to main content
POST
MiniMax Speech 2.8 HD синхронный синтез речи
Преобразует текст в речь, поддерживает различные голоса, управление эмоциями, регулировку скорости речи и другие функции. Ограничение длины текста — менее 10000 символов; если длина текста превышает 3000 символов, рекомендуется использовать потоковый вывод.

Заголовки запроса

string
обязательно
Перечисляемое значение: application/json
string
обязательно
Формат Bearer-аутентификации: Bearer {{API 密钥}}.

Тело запроса

string
обязательно
Текст, который необходимо синтезировать в речь. Ограничение длины — менее 10000 символов; если длина текста превышает 3000 символов, рекомендуется использовать потоковый вывод. Поддерживается переключение абзацев (символы новой строки), управление паузами (метка <#x#>), теги междометий/паралингвистических звуков (например, (laughs), (coughs) и т. д.; поддерживаются только speech-2.8-hd/turbo)
boolean
по умолчанию:false
Управляет тем, включен ли потоковый вывод. По умолчанию false, то есть потоковый вывод отключен
object
object
string
по умолчанию:"hex"
Параметр, управляющий формой результата вывода. Доступные значения: url, hex; значение по умолчанию — hex. Этот параметр действует только в непотоковом сценарии; в потоковом сценарии поддерживается возврат только в форме hex. Возвращаемый url действителен 24 часаДоступные значения: url, hex
object
boolean
по умолчанию:false
Управляет добавлением аудиоритмической метки в конец синтезированного аудио; значение по умолчанию — false. Этот параметр действует только для непотокового синтеза
string
Нужно ли усилить распознавание указанных малораспространенных языков и диалектов. Значение по умолчанию — null; можно установить auto, чтобы модель определяла самостоятельноДоступные значения: Chinese, Chinese,Yue, English, Arabic, Russian, Spanish, French, Portuguese, German, Turkish, Dutch, Ukrainian, Vietnamese, Indonesian, Japanese, Italian, Korean, Thai, Polish, Romanian, Greek, Czech, Finnish, Hindi, Bulgarian, Danish, Hebrew, Malay, Persian, Slovak, Swedish, Croatian, Filipino, Hungarian, Norwegian, Slovenian, Catalan, Nynorsk, Tamil, Afrikaans, auto
object
object[]
Настройки смешанного голоса; поддерживается смешивание максимум 4 голосов
boolean
по умолчанию:false
Управляет включением сервиса субтитров; значение по умолчанию — false. Этот параметр действует только в сценариях непотокового вывода и только для моделей speech-2.6-hd, speech-2.6-turbo, speech-01-turbo, speech-01-hd
boolean
по умолчанию:false
Включите этот параметр, чтобы сделать переходы между подпредложениями более естественными; поддерживается только моделями speech-2.8-hd и speech-2.8-turbo
object

Информация об ответе

object
Возвращаемый объект синтезированных данных; может быть null, требуется проверка на непустое значение
string
id текущей сессии, используется для помощи в локализации проблемы при обращении за консультацией/отправке отзыва
object
Код состояния и сведения текущего запроса
object
Дополнительная информация об аудио