> ## Documentation Index
> Fetch the complete documentation index at: https://docs.jiekou.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Wanxiang Wan 2.7 Referenz-zu-Video

Das Wanxiang Wan 2.7 Referenz-zu-Video-Modell unterstützt multimodale Eingaben (Text/Bild/Video). Es kann Personen oder Objekte als Hauptfiguren verwenden und Videos mit Einzelfiguren-Performances oder Interaktionen mehrerer Figuren generieren. Es unterstützt intelligente Szenenaufteilung und die Generierung von Videos mit mehreren Einstellungen. Unterstützt Auflösungen von 720P und 1080P, eine Dauer von 2 bis 10 Sekunden und wird sekundengenau abgerechnet. Die Ausgabe enthält standardmäßig Audio.

<Tip>
  Dies ist eine **asynchrone** API und gibt nur die task\_id der asynchronen Aufgabe zurück. Verwenden Sie diese task\_id, um die [API zum Abfragen des Aufgabenergebnisses](/de/docs/models/reference-get-async-task-result) aufzurufen und das generierte Ergebnis abzurufen.
</Tip>

## Anfrage-Header

<ParamField header="Content-Type" type="string" required={true}>
  Enumerationswert: `application/json`
</ParamField>

<ParamField header="Authorization" type="string" required={true}>
  Bearer-Authentifizierungsformat: Bearer \{\{API Key}}.
</ParamField>

## Anfragekörper

<ParamField body="seed" type="integer">
  Zufallszahl-Seed zur Verbesserung der Reproduzierbarkeit der generierten Ergebnisse. Wertebereich \[0, 2147483647].

  Wertebereich: \[0, 2147483647]
</ParamField>

<ParamField body="size" type="string" default="1920*1080">
  Auflösung des Ausgabevideos (Breite*Höhe), beeinflusst die Kosten. 720P-Stufe: 1280*720 (16:9), 720*1280 (9:16), 960*960 (1:1), 1088*832 (4:3), 832*1088 (3:4). 1080P-Stufe: 1920*1080 (16:9), 1080*1920 (9:16), 1440*1440 (1:1), 1632*1248 (4:3), 1248\*1632 (3:4).

  Optionale Werte: `1280*720`, `720*1280`, `960*960`, `1088*832`, `832*1088`, `1920*1080`, `1080*1920`, `1440*1440`, `1632*1248`, `1248*1632`
</ParamField>

<ParamField body="audio" type="boolean" default={true}>
  Ob ein Video mit Ton generiert werden soll; beeinflusst die Kosten. Standardmäßig true (Video mit Ton).
</ParamField>

<ParamField body="media" type="object[]" required={true}>
  Array von Referenzmedien zum Extrahieren von Figurenerscheinung, Bewegungen und Stimmfarbe. Entspricht in der Reihenfolge des Arrays character1, character2 usw. im prompt. Anzahl der Bilder: 0–5, Anzahl der Videos: 0–3, Gesamtanzahl maximal 5. Bildformate: JPEG, JPG, PNG, BMP, WEBP, Auflösung \[240,8000] Pixel, maximal 10 MB. Videoformate: MP4, MOV, Dauer 1–30 Sekunden, maximal 100 MB. Audioformate: MP3, WAV, FLAC, Dauer 3–30 Sekunden.

  Array-Länge: 1 - 5

  <Expandable title="properties" defaultOpen={true}>
    <ParamField body="url" type="string" required={true}>
      URL der Mediendatei.
    </ParamField>

    <ParamField body="type" type="string" required={true}>
      Medientyp. reference\_image: Referenzbild zum Extrahieren der Figurenerscheinung; reference\_video: Referenzvideo zum Extrahieren von Bewegungen und Erscheinung der Figur; first\_frame: Erstes Frame-Bild zur Steuerung des Startbilds des Videos.

      Optionale Werte: `reference_image`, `reference_video`, `first_frame`
    </ParamField>

    <ParamField body="reference_voice" type="string">
      URL des Referenzaudios der Figur, zum Klonen der Stimmfarbe der Figur und Generieren eines Videos mit Ton. Format: MP3, WAV, FLAC, Dauer 3–30 Sekunden.
    </ParamField>
  </Expandable>
</ParamField>

<ParamField body="prompt" type="string" required={true}>
  Text-Prompt zur Beschreibung der gewünschten Elemente und visuellen Merkmale im generierten Video. Referenzfiguren werden über Kennzeichnungen wie character1, character2 usw. referenziert; jede Referenz (Video oder Bild) enthält nur eine einzelne Figur. Unterstützt Chinesisch und Englisch, maximal 1500 Zeichen.

  Längenbegrenzung: 0 - 1500
</ParamField>

<ParamField body="duration" type="integer" default={5}>
  Dauer des generierten Videos in Sekunden; sekundengenaue Abrechnung. Ganzzahliger Wertebereich \[2, 10].

  Wertebereich: \[2, 10]
</ParamField>

<ParamField body="shot_type" type="string" default="single">
  Einstellungstyp. single steht für eine einzelne Einstellung (Standard), multi steht für mehrere Einstellungen. Dieser Parameter hat eine höhere Priorität als der prompt.

  Optionale Werte: `single`, `multi`
</ParamField>

<ParamField body="watermark" type="boolean" default={false}>
  Ob ein Wasserzeichen hinzugefügt werden soll; das Wasserzeichen befindet sich unten rechts im Video.
</ParamField>

<ParamField body="negative_prompt" type="string">
  Negativer Prompt zur Beschreibung von Inhalten, die nicht im Videobild erscheinen sollen. Unterstützt Chinesisch und Englisch, maximal 500 Zeichen.

  Längenbegrenzung: 0 - 500
</ParamField>

## Antwortinformationen

<ResponseField name="task_id" type="string" required={false}>
  Verwenden Sie task\_id, um die [API zum Abfragen des Aufgabenergebnisses](/de/docs/models/reference-get-async-task-result) aufzurufen und die generierte Ausgabe abzurufen.
</ResponseField>
