> ## Documentation Index
> Fetch the complete documentation index at: https://docs.jiekou.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Synthèse vocale ElevenLabs Flash V2

Convertissez du texte en parole avec la voix de votre choix et renvoie l’audio.

## En-têtes de requête

<ParamField header="Content-Type" type="string" required={true}>
  Valeurs d’énumération : `application/json`
</ParamField>

<ParamField header="Authorization" type="string" required={true}>
  Format d’authentification Bearer : Bearer \{\{API Key}}.
</ParamField>

## Corps de la requête

<ParamField body="seed" type="integer">
  Si spécifié, le système essaiera d’échantillonner de manière déterministe. Les requêtes répétées avec le même seed et les mêmes paramètres devraient renvoyer le même résultat, mais le déterminisme total n’est pas garanti.

  Plage de valeurs : \[0, 4294967295]
</ParamField>

<ParamField body="text" type="string" required={true}>
  Le texte à convertir en parole.
</ParamField>

<ParamField body="stream" type="boolean">
  Indique s’il faut activer le mode Stream
</ParamField>

<ParamField body="voice_id" type="string" required={true}>
  L’ID de la voix à utiliser.
</ParamField>

<ParamField body="next_text" type="string">
  Le texte qui suit le texte de la requête actuelle. Utilisé pour améliorer la cohérence de la voix lors de la concaténation de plusieurs générations.
</ParamField>

<ParamField body="language_code" type="string">
  Code de langue (ISO 639-1) utilisé pour le modèle et la normalisation du texte. Si le modèle ne prend pas en charge ce code de langue, une erreur sera renvoyée.
</ParamField>

<ParamField body="output_format" type="string" default="mp3_44100_128">
  Format de sortie de l’audio généré. Le format est codec\_sample\_rate\_bitrate. Le débit MP3 de 192 kbps nécessite un compte Creator ou supérieur, et la fréquence d’échantillonnage PCM de 44,1 kHz nécessite un compte Pro ou supérieur.

  Valeurs possibles : `mp3_22050_32`, `mp3_24000_48`, `mp3_44100_32`, `mp3_44100_64`, `mp3_44100_96`, `mp3_44100_128`, `mp3_44100_192`, `pcm_8000`, `pcm_16000`, `pcm_22050`, `pcm_24000`, `pcm_32000`, `pcm_44100`, `pcm_48000`, `ulaw_8000`, `alaw_8000`, `opus_48000_32`, `opus_48000_64`, `opus_48000_96`, `opus_48000_128`, `opus_48000_192`
</ParamField>

<ParamField body="previous_text" type="string">
  Le texte qui précède le texte de la requête actuelle. Utilisé pour améliorer la cohérence de la voix lors de la concaténation de plusieurs générations.
</ParamField>

<ParamField body="use_pvc_as_ivc" type="boolean" default={false}>
  Si true, utilise la version IVC de la voix au lieu de la version PVC. Il s’agit d’une solution temporaire pour la latence élevée de la version PVC.
</ParamField>

<ParamField body="voice_settings" type="object">
  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="speed" type="number" default={1}>
      Ajuste la vitesse de la voix. 1.0 est la vitesse par défaut ; une valeur inférieure à 1.0 ralentit le débit, tandis qu’une valeur supérieure à 1.0 l’accélère.
    </ParamField>

    <ParamField body="style" type="number" default={0}>
      Détermine le degré d’exagération du style vocal. Tente d’amplifier le style du locuteur d’origine. Une valeur différente de 0 consomme davantage de ressources de calcul et peut augmenter la latence.
    </ParamField>

    <ParamField body="stability" type="number" default={0.5}>
      Détermine la stabilité de la génération vocale et le niveau d’aléatoire entre chaque génération. Des valeurs plus faibles offrent une plage émotionnelle plus large, tandis que des valeurs plus élevées peuvent rendre la voix monotone.
    </ParamField>

    <ParamField body="similarity_boost" type="number" default={0.75}>
      Détermine dans quelle mesure l’IA tente de reproduire fidèlement la voix d’origine.
    </ParamField>

    <ParamField body="use_speaker_boost" type="boolean" default={true}>
      Renforce la similarité avec le locuteur d’origine. Nécessite une charge de calcul légèrement plus élevée et augmente la latence.
    </ParamField>
  </Expandable>
</ParamField>

<ParamField body="next_request_ids" type="string[]">
  Liste des request\_id des échantillons suivants. Utilisée pour maintenir la cohérence de la voix lors de la régénération d’échantillons. Jusqu’à 3 request\_id peuvent être transmis.

  Longueur du tableau : 0 - 3
</ParamField>

<ParamField body="previous_request_ids" type="string[]">
  Liste des request\_id des échantillons déjà générés avant la génération actuelle. Peut être utilisée pour améliorer la cohérence de la voix. Jusqu’à 3 request\_id peuvent être transmis.

  Longueur du tableau : 0 - 3
</ParamField>

<ParamField body="apply_text_normalization" type="string" default="auto">
  Contrôle la normalisation du texte. 'auto' laisse le système décider, 'on' normalise toujours, et 'off' l’ignore.

  Valeurs possibles : `auto`, `on`, `off`
</ParamField>

<ParamField body="apply_language_text_normalization" type="boolean" default={false}>
  Contrôle la normalisation linguistique du texte pour certaines langues prises en charge afin d’obtenir une prononciation plus naturelle. Avertissement : cela peut augmenter considérablement la latence. Actuellement, seul le japonais est pris en charge.
</ParamField>

<ParamField body="pronunciation_dictionary_locators" type="object[]">
  Liste des localisateurs de dictionnaire de prononciation (id, version\_id) à appliquer au texte. Ils prennent effet dans l’ordre. Chaque requête peut contenir jusqu’à 3 localisateurs.

  Longueur du tableau : 0 - 3

  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="version_id" type="string">
      ID de la version du dictionnaire de prononciation. Si non spécifié, la dernière version est utilisée.
    </ParamField>

    <ParamField body="pronunciation_dictionary_id" type="string" required={true}>
      ID du dictionnaire de prononciation.
    </ParamField>
  </Expandable>
</ParamField>

## Informations de réponse

Fichier audio généré

Format : `binary`
