Skip to main content
POST

Autorización

string
requerido
Todos los endpoints de la API requieren autenticación mediante Bearer TokenObtenga su API Key:Visite la página de gestión de API Keys para obtener su API KeyAñádala al encabezado de la solicitud:

Modos de generación

SkyReels V4 se enruta automáticamente al modo correcto según los campos de la solicitud — no se necesita el campo mode:
Exclusión mutua estricta: los campos I2V (first_frame_image / end_frame_image / mid_frame_images) y los campos Omni (ref_images / ref_videos) no pueden usarse juntos; de lo contrario, se devuelve 422.
Mecanismo @tag: Al usar mid_frame_images / ref_images / ref_videos, cada elemento debe declarar un tag que comience con @ (por ejemplo, @image1, @Actor-1, @video1), y el tag debe aparecer en el prompt.Piense en el prompt como un “guion” y en el tag como un “puntero de personaje” hacia activos específicos (imágenes / videos). Por ejemplo, un prompt como "@Actor-1 walks into the scene of @video1" indica al sistema que inyecte el sujeto de la imagen de referencia ligado a @Actor-1 y la referencia de movimiento ligada a @video1 en el proceso de generación.

Parámetros de la solicitud

Campos generales

string
requerido
Hay dos niveles de modelo disponibles:
El campo model debe proporcionarse explícitamente — no tiene valor por defecto.
El precio está fuertemente ligado a la resolución y al uso de ref_videos: 1080p es significativamente más caro que 480p / 720p; los niveles con ref_videos (entrada de video) cuestan ~1.5 ~ 2× en comparación con los que no lo usan. Aún no se admite la salida simultánea de audio y video.
boolean
predeterminado:"false"
Indica si se debe moderar el contenido antes de enviar la tarea de vídeo.
  • true: revisar los prompts y las imágenes de entrada con omni-moderation-latest
  • false u omitido: no enviar una solicitud de moderación, sin coste ni latencia de moderación adicionales (predeterminado)
string
requerido
Prompt de texto, máximo 1280 tokensDescriba escenas, sujetos, acciones y estilos en detalle para obtener mejores resultados.Al usar ref_images / ref_videos / mid_frame_images, el prompt debe contener el @tag correspondiente (por ejemplo, @Actor-1, @video1, @image1).Ejemplo: "@Actor-1 walks through a neon-lit street at night."
integer
predeterminado:"5"
Duración del video de salida (segundos)
  • Rango: [3, 15]
  • Por defecto: 5
Cuando se proporciona ref_videos.type=reference, duration se sobrescribe con la longitud del video de referencia (máx. 10 segundos).
string
predeterminado:"1080p"
Resolución del videoOpciones:
  • 480p
  • 720p
  • 1080p (por defecto)
string
predeterminado:"16:9"
Proporción de aspectoOpciones:
  • 16:9 (por defecto)
  • 4:3
  • 1:1
  • 9:16
  • 3:4
aspect_ratio se ignora en modo I2V (la proporción de salida la determina la imagen de entrada); también se ignora cuando Omni se combina con ref_videos.
boolean
predeterminado:"true"
Si se debe optimizar el prompt automáticamenteCuando está activado, el sistema optimiza automáticamente su prompt para obtener mejores resultados.

Campos específicos de I2V

string
URL de la imagen del primer fotograma (jpg / jpeg / png / gif / bmp)Cuando se proporciona, esta imagen se utiliza como fotograma inicial del video.
string
URL de la imagen del último fotograma (jpg / jpeg / png / gif / bmp)Cuando se proporciona, esta imagen se utiliza como fotograma final del video. Puede combinarse con first_frame_image para el control de primer y último fotograma.
object[]
Lista de fotogramas clave intermedios, hasta 6. Cada elemento tiene la siguiente estructura:

Campos específicos de Omni

object[]
Lista de imágenes de referencia (todos los elementos deben compartir el mismo type). Cada elemento tiene la siguiente estructura:
object[]
Lista de videos de referencia, hasta 1. Cada elemento tiene la siguiente estructura:

Escenarios soportados

Los siguientes escenarios son soportados tanto por skyreels-v4-fast como por skyreels-v4-std:

Restricciones de parámetros

Violar cualquiera de las siguientes hará que la solicitud sea rechazada con una respuesta 422, sin facturación:

Respuesta

integer
Código de estado de la respuesta, 200 en caso de éxito
array
Array de datos de la respuesta

Ejemplos de solicitud

Caso 1: Texto a video (mínimo)

Caso 2: Texto a video (parámetros completos)

Caso 3: Imagen a video - Primer fotograma

Caso 4: Imagen a video - Primer/Último fotograma + fotogramas clave intermedios

Caso 5: Omni - Referencia de sujeto único

Caso 6: Omni - Multi-sujeto + referencia de movimiento por video

Este caso usa ref_videos.type=reference, por lo que la duration solicitada será sobrescrita por la longitud real del video de referencia (máx. 10 segundos). Aunque aquí se pase "duration": 5, la duración final del video sigue la del video de referencia.

Caso 7: Omni - Collage en cuadrícula

Caso 8: Omni - Extensión de video (extend)

Caso 9: Omni - Sincronización de audio (impulsado por voz)

Consultar resultados de la tareaLa generación de video es una tarea asíncrona que devuelve un task_id al enviarse. Use el endpoint Obtener estado de la tarea para consultar el progreso y los resultados de la generación.