Omni-Flash-Ext
Generación de video Omni-Flash-Ext
- Modelo unificado de generación de video Omni-Flash-Ext
- Admite Text-to-Video, Image-to-Video con una sola imagen, video de referencia y fusión con 3 imágenes de referencia
- Admite resolución 720p/1080p/4k y duración de 4/6/8/10 segundos
- API de tareas asíncronas. Primero envíe una tarea y luego consulte el resultado mediante el ID de la tarea
POST
Autenticación
string
requerido
Todas las solicitudes requieren autenticación mediante Bearer Token.Obtener una API key:Visite la página de gestión de API Keys para obtener su API key.Añada el siguiente encabezado al realizar solicitudes:
Parámetros de la solicitud
string
requerido
Nombre del modelo de generación de video. Debe ser
Omni-Flash-Ext.boolean
predeterminado:"false"
Indica si se debe moderar el contenido antes de enviar la tarea de vídeo.
true: revisar los prompts y las imágenes de entrada conomni-moderation-latestfalseu omitido: no enviar una solicitud de moderación, sin coste ni latencia de moderación adicionales (predeterminado)
string
requerido
Descripción del contenido del video. Recomendamos describir en detalle la escena, el sujeto, la acción, el entorno, los movimientos de cámara, el estilo visual y las indicaciones de audio.Ejemplo:
"a girl is dancing happily in a sunny garden"integer
predeterminado:"6"
Duración del video en segundos.Valores compatibles:
4, 6, 8, 10.string
predeterminado:"720p"
Resolución del video. Los valores no distinguen entre mayúsculas y minúsculas.Valores compatibles:
720p1080p4k
string
predeterminado:"16:9"
Relación de aspecto del video. Úselo para controlar la salida horizontal o vertical.Valores comunes:
16:9- horizontal9:16- vertical
16:9string
Campo de compatibilidad. Tiene el mismo significado que
aspect_ratio. Si se proporcionan ambos, manténgalos coherentes.string
Tipo de generación, usado para especificar cómo se utilizan las imágenes.Opciones:
frame- Modo de primer frame.image_urlssolo puede contener 1 imagen, usada como el primer frame del vídeo.reference- Modo de referencia.image_urlspuede contener 1 o 3 imágenes, usadas como imágenes de referencia.
array<url>
Array de URLs de imágenes de referencia. Puede omitirlo, proporcionar 1 imagen o proporcionar 3 imágenes, según
generation_type:- Omitido o array vacío: Text-to-Video
- 1 imagen: Image-to-Video con una sola imagen
- 3 imágenes: fusión de imágenes de referencia (solo se admite cuando
generation_typeesreference)
generation_type:generation_typeesframe: solo se puede subir 1 imagen.generation_typeesreference: se pueden subir 1 o 3 imágenes.
array<url>
Array de URLs de videos de referencia. Puede omitirlo o proporcionar 1 video de referencia.Solo se admiten URLs de video HTTP/HTTPS de acceso público. Puede enviarlo junto con
image_urls: las imágenes se usan como referencia de identidad o composición, mientras que el video se usa como referencia de movimiento.Respuesta
integer
Código de estado de la respuesta. Las solicitudes exitosas devuelven
200.array
Array de tareas devuelto.
Consultar el resultado de la tarea
La generación de video es asíncrona. Tras la solicitud, la API devuelve untask_id. Use el endpoint Obtener estado de la tarea para consultar el progreso y los resultados.
cURL
Ejemplo de resultado exitoso
Ejemplo de resultado fallido
Casos de uso
Escenario 1: Texto a video
Escenario 2: Video a partir de una sola imagen
Escenario 3: Fusión con 3 imágenes de referencia
Escenario 4: Video corto 4K
Escenario 5: Generación con video de referencia
Códigos de error
Cuando una tarea falla, la API de estado de la tarea devuelve el motivo del fallo en
data.error. Las causas comunes incluyen el agotamiento temporal de la cuota upstream, el fallo en la moderación de contenido o el tiempo de espera agotado en el upstream.