> ## Documentation Index
> Fetch the complete documentation index at: https://docs.jiekou.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Wanxiang Wan 2.7 — vidéo générée à partir de références

Le modèle Wanxiang Wan 2.7 de vidéo générée à partir de références prend en charge les entrées multimodales (texte/image/vidéo) et peut utiliser une personne ou un objet comme protagoniste pour générer des vidéos de performance à rôle unique ou d’interaction entre plusieurs rôles. Il prend en charge le découpage intelligent en scènes afin de générer des vidéos multi-plans. Les résolutions 720P et 1080P sont prises en charge, avec une durée de 2 à 10 secondes et une facturation à la seconde. La sortie inclut l’audio par défaut.

<Tip>
  Il s’agit d’une API **asynchrone** qui renvoie uniquement le task\_id de la tâche asynchrone. Vous devez utiliser ce task\_id pour appeler l’[API de consultation du résultat de tâche](/fr/docs/models/reference-get-async-task-result) afin de récupérer le résultat généré.
</Tip>

## En-têtes de requête

<ParamField header="Content-Type" type="string" required={true}>
  Valeur d’énumération : `application/json`
</ParamField>

<ParamField header="Authorization" type="string" required={true}>
  Format d’authentification Bearer : Bearer \{\{API Key}}.
</ParamField>

## Corps de la requête

<ParamField body="seed" type="integer">
  Graine aléatoire utilisée pour améliorer la reproductibilité des résultats générés. Plage de valeurs \[0, 2147483647].

  Plage de valeurs : \[0, 2147483647]
</ParamField>

<ParamField body="size" type="string" default="1920*1080">
  Résolution de la vidéo de sortie (largeur*hauteur), qui influe sur le coût. Gamme 720P : 1280*720 (16:9), 720*1280 (9:16), 960*960 (1:1), 1088*832 (4:3), 832*1088 (3:4). Gamme 1080P : 1920*1080 (16:9), 1080*1920 (9:16), 1440*1440 (1:1), 1632*1248 (4:3), 1248\*1632 (3:4).

  Valeurs possibles : `1280*720`, `720*1280`, `960*960`, `1088*832`, `832*1088`, `1920*1080`, `1080*1920`, `1440*1440`, `1632*1248`, `1248*1632`
</ParamField>

<ParamField body="audio" type="boolean" default={true}>
  Indique s’il faut générer une vidéo avec son, ce qui influe sur le coût. Par défaut : true (vidéo avec son).
</ParamField>

<ParamField body="media" type="object[]" required={true}>
  Tableau de médias de référence, utilisé pour extraire l’apparence du personnage, les mouvements et le timbre vocal. Correspond à character1, character2, etc. dans le prompt selon l’ordre du tableau. Nombre d’images : 0 à 5 ; nombre de vidéos : 0 à 3 ; total maximal : 5. Formats d’image : JPEG, JPG, PNG, BMP, WEBP, résolution \[240,8000] pixels, maximum 10 MB. Formats vidéo : MP4, MOV, durée de 1 à 30 secondes, maximum 100 MB. Formats audio : MP3, WAV, FLAC, durée de 3 à 30 secondes.

  Longueur du tableau : 1 - 5

  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="url" type="string" required={true}>
      URL du fichier média.
    </ParamField>

    <ParamField body="type" type="string" required={true}>
      Type de média. reference\_image : image de référence, utilisée pour extraire l’apparence du personnage ; reference\_video : vidéo de référence, utilisée pour extraire les mouvements et l’apparence du personnage ; first\_frame : image de première frame, permettant de contrôler l’image de départ de la vidéo.

      Valeurs possibles : `reference_image`, `reference_video`, `first_frame`
    </ParamField>

    <ParamField body="reference_voice" type="string">
      URL de l’audio de référence du personnage, utilisée pour cloner le timbre vocal du personnage et générer une vidéo avec son. Formats : MP3, WAV, FLAC, durée de 3 à 30 secondes.
    </ParamField>
  </Expandable>
</ParamField>

<ParamField body="prompt" type="string" required={true}>
  Prompt textuel utilisé pour décrire les éléments et caractéristiques visuelles souhaités dans la vidéo générée. Les personnages de référence sont cités via des identifiants tels que character1, character2, etc. Chaque référence (vidéo ou image) ne contient qu’un seul personnage. Le chinois et l’anglais sont pris en charge, avec un maximum de 1500 caractères.

  Limite de longueur : 0 - 1500
</ParamField>

<ParamField body="duration" type="integer" default={5}>
  Durée de la vidéo générée, en secondes, facturée à la seconde. Doit être un entier dans la plage \[2, 10].

  Plage de valeurs : \[2, 10]
</ParamField>

<ParamField body="shot_type" type="string" default="single">
  Type de plan. single correspond à un plan unique (par défaut), multi à plusieurs plans. Ce paramètre a une priorité supérieure à celle du prompt.

  Valeurs possibles : `single`, `multi`
</ParamField>

<ParamField body="watermark" type="boolean" default={false}>
  Indique s’il faut ajouter un filigrane, situé dans l’angle inférieur droit de la vidéo.
</ParamField>

<ParamField body="negative_prompt" type="string">
  Prompt négatif utilisé pour décrire le contenu que vous ne souhaitez pas voir apparaître dans les images de la vidéo. Le chinois et l’anglais sont pris en charge, avec un maximum de 500 caractères.

  Limite de longueur : 0 - 500
</ParamField>

## Informations de réponse

<ResponseField name="task_id" type="string" required={false}>
  Utilisez le task\_id pour appeler l’[API de consultation du résultat de tâche](/fr/docs/models/reference-get-async-task-result) afin de récupérer la sortie générée.
</ResponseField>
