Skip to main content
POST
Gemini 2.5 Flash TTS テキスト読み上げ
Vertex AI generateContent インターフェースに基づいてテキストを音声に変換します。リクエストボディの形式は公式 Vertex AI API と完全に一致しています。同期(単一リクエスト・単一レスポンス)とストリーミング(単一リクエスト・ストリーミングレスポンス)の 2 つのモードに対応しています。出力は LINEAR16 PCM 形式(24kHz、モノラル、16-bit signed little-endian)で、WAV ヘッダーは含まれません。

リクエストヘッダー

string
必須
列挙値: application/json
string
必須
Bearer 認証形式: Bearer {{API Key}}。

リクエストボディ

object
必須
object
必須

レスポンス情報

string
Base64 エンコードされた音声コンテンツ。形式は LINEAR16 PCM(24kHz、モノラル、16-bit signed little-endian)で、WAV ヘッダーは含まれません。クライアントは ffmpeg を使用して変換できます:ffmpeg -f s16le -ar 24k -ac 1 -i input.raw output.wav
object