Skip to main content
POST
MiniMax Speech-2.6-hd asynchrone Sprachsynthese
Diese API unterstützt die asynchrone Generierung von Sprache auf Basis von Text-to-Speech. Pro Textgenerierungsübertragung werden maximal 1 Million Zeichen unterstützt; das vollständige generierte Audioergebnis kann asynchron abgerufen werden. Unterstützt werden über 100 Systemstimmen sowie frei wählbare geklonte Stimmen; Intonation, Sprechgeschwindigkeit, Lautstärke, Bitrate, Abtastrate und Ausgabeformat können individuell angepasst werden. Nachdem Sie eine Anfrage zur Sprachsynthese langer Texte eingereicht haben, beachten Sie bitte, dass die zurückgegebene url ab dem Zeitpunkt der Rückgabe 24 Stunden gültig ist. Achten Sie daher auf den Zeitpunkt des Herunterladens der Informationen.
Geeignet für die Sprachgenerierung langer Texte wie ganzer Bücher; die Wartezeit in der Aufgabenwarteschlange kann relativ lang sein. Für Szenarien wie die Generierung kurzer Sätze, Sprachchats und Online-Social-Anwendungen wird die Verwendung des synchronen Aufrufs der Sprachsynthese empfohlen.

Anfrage-Header

string
erforderlich
Enumerationswert: application/json
string
erforderlich
Bearer-Authentifizierungsformat: Bearer {{API Key}}.

Anfragebody

string
erforderlich
Der zu synthetisierende Text, begrenzt auf maximal 50.000 Zeichen.
object
erforderlich
object
object
string
Standard:"null"
Verbessert die Erkennungsfähigkeit für angegebene weniger verbreitete Sprachen und Dialekte. Nach der Einstellung kann die Sprachleistung in Szenarien mit der angegebenen weniger verbreiteten Sprache/dem angegebenen Dialekt verbessert werden. Wenn der Typ der weniger verbreiteten Sprache nicht eindeutig ist, kann “auto” gewählt werden; das Modell bestimmt dann selbstständig den Typ der weniger verbreiteten Sprache. Unterstützte Werte:'Chinese', 'Chinese,Yue', 'English', 'Arabic', 'Russian', 'Spanish', 'French', 'Portuguese', 'German', 'Turkish', 'Dutch', 'Ukrainian', 'Vietnamese', 'Indonesian', 'Japanese', 'Italian', 'Korean', 'Thai', 'Polish', 'Romanian', 'Greek', 'Czech', 'Finnish', 'Hindi', 'Bulgarian', 'Danish', 'Hebrew', 'Malay', 'Persian', 'Slovak', 'Swedish', 'Croatian', 'Filipino', 'Hungarian', 'Norwegian', 'Slovenian', 'Catalan', 'Nynorsk', 'Tamil', 'Afrikaans', 'auto'
object
Einstellungen für den Stimmeffekt. Dieser Parameter unterstützt die Audioformate: mp3, wav, flac

Antwortparameter

string
erforderlich
Die task_id der asynchronen Aufgabe. Sie sollten diese task_id verwenden, um die API zum Abfragen des Aufgabenergebnisses anzufordern und das Generierungsergebnis zu erhalten