Skip to main content
POST

Autorización

string
requerido
Todos los endpoints de la API requieren autenticación mediante Bearer TokenObtenga su API Key:Visite la página de gestión de API Keys para obtener su API KeyAñádala al encabezado de la solicitud:

Parámetros de la solicitud

string
requerido
Nombre del modelo de generación de videoModelos compatibles:
  • kling-v3 - Kling v3 (recomendado)
boolean
predeterminado:"false"
Indica si se debe moderar el contenido antes de enviar la tarea de vídeo.
  • true: revisar los prompts y las imágenes de entrada con omni-moderation-latest
  • false u omitido: no enviar una solicitud de moderación, sin coste ni latencia de moderación adicionales (predeterminado)
string
requerido
Prompt de textoDescriba escenas, acciones y estilos en detalle para obtener mejores resultados. Se recomienda utilizar prompts en inglés.Ejemplo: "a golden retriever running on the beach, sunset, cinematic"
string
Prompt negativo para excluir contenido no deseadoEjemplo: "blurry, low quality, distorted"
string
predeterminado:"std"
Modo de generaciónOpciones:
  • std - Modo estándar (720P)
  • pro - Modo profesional (1080P)
  • 4k - Modo 4K
Predeterminado: std
integer
predeterminado:"5"
Predeterminado: 5 Duración del video (segundos)Rango: 3-15 (mínimo 3 segundos, máximo 15 segundos)⚠️ Nota: Debe ser un número simple (por ejemplo, 6), sin comillas, de lo contrario se producirá un error
string
predeterminado:"16:9"
Relación de aspecto del videoOpciones:
  • 16:9 - Horizontal
  • 9:16 - Vertical
  • 1:1 - Cuadrado
Predeterminado: 16:9
array<url>
Array de URLs de imágenes para la generación image-to-video
  • Pase 1 imagen: se usa como primer frame
  • Pase 2 imágenes: se asignan automáticamente como primer frame + último frame
Se admiten hasta 2 imágenesEjemplo: ["https://example.com/first.jpg"]
  • Se admiten hasta 2 imágenes
  • Las URLs de imágenes deben ser de acceso público, sin protección contra hotlinking
  • En el modo image-to-video, aspect_ratio puede ser sobrescrito por la relación real de la imagen
boolean
Define si se añade una marca de agua
boolean
predeterminado:"false"
Define si se genera el video con audio
boolean
predeterminado:"false"
Define si se activa el modo multi-shot (varios planos).
  • true
  • false
string
Método de división de planos: customize / intelligence.Obligatorio cuando multi_shot=true.
array<object>
Información por plano, como prompt y duración.Defina el orden, el prompt y la duración de los planos mediante index, prompt y duration.
  • Admite de 1 a 6 planos
  • La longitud máxima del contenido por plano es 512
  • La duración de cada plano debe ser >= 1 y no puede exceder la duración total de la tarea
  • La suma de las duraciones de todos los planos debe ser igual al duration de nivel superior
Formato:
Obligatorio cuando multi_shot=true y shot_type=customize.
array<object>
Lista de sujetos de referencia, hasta 3 sujetos.
  • Creados al instante mediante name, description, element_input_urls
Ejemplo:
Notas:
  • Para la creación al instante, name, description y element_input_urls son obligatorios
  • element_input_urls: 2-4 imágenes por sujeto (la primera como imagen frontal, las demás como referencias)
  • Referencie los elementos en prompt con @name, por ejemplo, "@element_dog chasing @element_cat on grass"

Restricciones de parámetros

  • mode=4k es compatible con kling-v3
  • image_urls admite hasta 2 imágenes (1 primer frame, 2 primer+último frames)
  • La entrada solo del último frame no es válida (debe incluir el primer frame)
  • Cuando multi_shot=true, el prompt de nivel superior puede omitirse
  • multi_prompt admite hasta 6 planos, e index debe comenzar en 1 y ser continuo

Matriz de compatibilidad de funciones

Texto a video (Text-to-Video) vs Imagen a video (Image-to-Video)

El sistema determina automáticamente el modo según si se proporciona o no image_urls: sin imágenes significa text-to-video, con imágenes significa image-to-video.

Respuesta

integer
Código de estado de la respuesta, 200 en caso de éxito
array
Array de datos de la respuesta

Casos de uso

Caso 1: Texto a video (Modo estándar)

Caso 2: Texto a video (Modo Pro + prompt negativo)

Caso 3: Texto a video (15 segundos)

Caso 4: Imagen a video (Primer frame)

Caso 5: Imagen a video (Control de primer + último frame)

Caso 6: Generar video con audio

Caso 7: Storyboard multi-shot (customize, 15 segundos, vertical con audio)

Consultar los resultados de la tareaLa generación de video es una tarea asíncrona que devuelve un task_id al enviarse. Use el endpoint Obtener estado de la tarea para consultar el progreso y los resultados de la generación.