Imágenes
Seedream
POST
Seedream
Los parámetros y el uso están alineados con la documentación oficial; para parámetros detallados, consulte directamente la documentación oficial.
Encabezados de la solicitud:
Consulte el protocolo upstream del modelo seleccionado para confirmar los valores disponibles y los límites de cantidad de los parámetros de series de imágenes.
1. Descripción general
La API de generación de imágenes Seedream utiliza un formato de solicitud de generación de imágenes al estilo OpenAI, compatible con generación de texto a imagen, generación de imagen a imagen y edición de imágenes. Los cuatro modelos utilizan la misma interfaz; el cliente solo necesita seleccionar el modelo en el campomodel del body de la solicitud.
Modelos compatibles
2. Interfaz y autenticación
{api_domain} corresponde al dominio de la API de su plataforma. La solicitud debe usar POST y el body debe ser JSON.
3. Parámetros de la solicitud
3.1 Parámetros generales
string
requerido
Use el ID de modelo de la tabla anterior.
string
requerido
Descripción de la imagen; admite chino e inglés.
string / string[]
URL de la imagen de referencia o Data URL en Base64. Puede enviar una sola imagen o un array. La cantidad y las restricciones de imágenes están sujetas a los límites del modelo seleccionado.
string
Use los niveles de resolución compatibles con el modelo o
anchoxalto. Si no se proporciona, se usa el valor predeterminado del modelo.string
url o b64_json; por defecto url.string
Solo compatible con Seedream 5.0 Lite y 5.0 Pro:
jpeg o png. Seedream 4.0 y 4.5 generan siempre salida en JPEG; si se envía output_format, la solicitud será rechazada.boolean
Si se añade una marca de agua de generación por IA.
boolean
La interfaz de imágenes no admite salida en streaming; no envíe
true.3.2 Parámetros específicos del modelo
Seedream 5.0 Pro no admite
sequential_image_generation ni sequential_image_generation_options; el envío de cualquiera de estos campos será rechazado. No envíe a Pro los parámetros específicos de los demás modelos.
3.3 Ejemplo de texto a imagen
La siguiente solicitud toma Seedream 5.0 Pro como ejemplo. Los cuatro modelos comparten la misma interfaz; al usar Seedream 4.0 o 4.5 debe eliminaroutput_format, y este campo solo puede enviarse al usar Seedream 5.0 Lite/Pro:
3.4 Ejemplo de imagen a imagen
image puede ser una URL individual, un Data URL en Base64 individual o un array de cadenas:
3.5 Ejemplo de serie de imágenes (solo 4.0, 4.5 y 5.0 Lite)
Los parámetros de series de imágenes pertenecen a los tres primeros modelos. Ejemplo:4. Respuesta
Ejemplo de respuesta exitosa:- Cuando
response_format=url, se devuelvedata[].url; cuandoresponse_format=b64_json, se devuelvedata[].b64_json. - Seedream 4.0, 4.5 y 5.0 Lite pueden devolver varios elementos
dataen modo de serie de imágenes. - Seedream 5.0 Pro devuelve un elemento
dataen el escenario de generación de imágenes; al activar la descomposición en capas, devuelve varios elementosdata(una imagen base + varias capas), y cada elemento incluye adicionalmente el orden de apilamiento de capasz_index(la imagen base es 0), el nombrename, la descripcióndescriptiony el cuadro delimitadorbounding_box(con coordenadas absolute / normalized; la imagen base no devuelve este campo). modeldevuelve el ID de modelo del cliente utilizado en esta solicitud.- La validez de la URL de la imagen está determinada por la plataforma y el servicio upstream; descargue y guarde las imágenes oportunamente después de recibirlas.
5. Restricciones del modelo
Seedream 4.0 / 4.5 / 5.0 Lite
- Compatible con generación de texto a imagen, generación de imagen a imagen y generación de series de imágenes.
- Las series de imágenes utilizan
sequential_image_generationy sus campos de opciones. - El número de imágenes de entrada, el tamaño de las imágenes, la resolución y la relación de aspecto se rigen por la documentación upstream del modelo correspondiente. Seedream 4.0 y 4.5 generan siempre salida en JPEG y no admiten el parámetro de solicitud
output_format; Seedream 5.0 Lite admitejpegypng.
Seedream 5.0 Pro
- Compatible con generación de texto a imagen, generación a partir de una sola imagen y fusión de múltiples imágenes.
- En el escenario de generación de imágenes, devuelve una imagen exitosa. Al activar la descomposición en capas (
layer_decomposition: true), devuelve una imagen base y varias capas (hasta 16 capas), en cuyo casodatacontiene varios elementos. No admite la generación de series de imágenes (sequential_image_generation). - No admite
sequential_image_generationnisequential_image_generation_options. sizepuede usar 1K, 1.5K, 2K o unanchoxaltoexplícito.- Al especificar el ancho y el alto de forma explícita, la relación de aspecto y el total de píxeles deben cumplir las restricciones del modelo; las dimensiones reales de la imagen de salida se rigen por
data[].sizeen la respuesta. - Compatible con la descomposición en capas: al configurar
layer_decomposition: true, se descompone una única imagen de entrada en una imagen base y hasta 16 capas editables de forma independiente (cada capa es un PNG con canal alfa). En este escenario,imagees obligatorio y solo puede contener una imagen; si se envían varias, se produce un error. La descomposición en capas es de tipo “todo o nada”: si cualquier capa falla, toda la solicitud falla; no se admite el éxito parcial. - Reglas de
sizepara la descomposición en capas: la resolución de la imagen base es igual asize; la resolución de cada capa es cercana asize, pero cada capa mantiene la relación de aspecto de su región correspondiente en la imagen original, por lo que los píxeles reales de cada capa difieren. Esto significa que las imágenes de salida de una misma solicitud pueden caer en diferentes niveles de precio por píxeles.sizepuede ser 1K, 1.5K, 2K o auto; por defecto es auto.
6. Facturación y uso
- 4.0, 4.5 y 5.0 Lite se facturan según la cantidad de imágenes generadas exitosamente; en la generación de series de imágenes, se calcula según la cantidad de salidas realmente exitosas.
- 5.0 Pro se factura según las imágenes de salida exitosas; con múltiples imágenes de entrada, la primera imagen de referencia es gratuita y las imágenes de referencia adicionales se miden por separado; los diferentes tamaños de salida corresponden a distintos niveles de precio. Al activar la descomposición en capas, la imagen base y cada capa cuentan como una imagen de salida exitosa, y cada una se factura por separado según el nivel de precio correspondiente a los píxeles de su
data[].size(por ejemplo, la imagen base en el nivel de alta resolución y algunas capas en el nivel de baja resolución); la factura final es la suma de las cantidades de cada nivel. - La unidad de uso es “imagen” o item.