Skip to main content
POST

Autorización

string
requerido
Todos los endpoints de la API requieren autenticación mediante Bearer TokenObtenga su API Key:Visite la página de gestión de API Keys para obtener su API KeyAñádala al encabezado de la solicitud:

Parámetros de la solicitud

string
requerido
Nombre del modelo de generación de videoModelos compatibles:
  • kling-video-o1 - Kling Video O1 (mejorado por razonamiento, la más alta calidad)
boolean
predeterminado:"false"
Indica si se debe moderar el contenido antes de enviar la tarea de vídeo.
  • true: revisar los prompts y las imágenes de entrada con omni-moderation-latest
  • false u omitido: no enviar una solicitud de moderación, sin coste ni latencia de moderación adicionales (predeterminado)
string
requerido
Prompt de texto positivoEl prompt no debe superar los 2500 caracteres.Admite referenciar imágenes de image_urls usando la sintaxis <<<image_N>>>, donde N comienza en 1.Ejemplo: "Make the person in <<<image_1>>> wave at the camera"
Si se proporcionan imágenes pero el prompt no contiene ninguna referencia <<<image_N>>>, el sistema añadirá automáticamente <<<image_1>>> al principio del prompt.
string
predeterminado:"std"
Modo de generaciónOpciones:
  • std - Modo estándar (720P)
  • pro - Modo profesional (1080P)
Predeterminado: std
integer
predeterminado:"5"
Duración del video (segundos)Opciones: 5 o 10Predeterminado: 5
string
predeterminado:"16:9"
Relación de aspecto del videoOpciones:
  • 16:9 - Horizontal
  • 9:16 - Vertical
  • 1:1 - Cuadrado
Predeterminado: 16:9
array<url>
Array de URLs de imágenes para la referencia de imágenesReferencie las imágenes correspondientes en el prompt usando la sintaxis <<<image_N>>> (N comienza en 1)Ejemplo: ["https://example.png"]
  • Las URLs de imágenes deben ser de acceso público, sin protección contra hotlinking
  • En el modo image-to-video, aspect_ratio puede ser sobrescrito por la relación real de la imagen
  • Hasta dos imágenes. El primer elemento del array es el frame inicial, y el segundo es el frame final
array<object>
Array de imágenes basadas en roles, recomendado para image-to-video.Formato de cada elemento: { "url": "...", "role": "..." }
  • first_frame: primer frame
  • last_frame: último frame
  • reference: imagen de referencia
  • image_urls e image_with_roles son mutuamente excluyentes, no los envíe a la vez.
  • Cuando se proporcionan más de 2 imágenes, no se admite configurar los fotogramas inicial y final.
array
Lista de videos de referencia (basada en URL), hasta 1 video.Use refer_type para distinguir los tipos:
  • base: video a editar (predeterminado)
  • feature: video de referencia de características
Use keep_original_sound para controlar si se conserva el audio original:
  • no: no conservar (predeterminado)
  • yes: conservar el sonido original
Formato de la solicitud:
  • video_url no puede estar vacío y la URL del video debe ser accesible
  • Cuando refer_type=base:
    • No se pueden definir los frames inicial/final
    • El video de referencia debe durar entre 3 y 10 segundos
    • La duración del video generado sigue al video subido
  • Cuando refer_type=feature y video_url no está vacío:
    • image_urls solo puede incluir una imagen del primer frame
  • Requisitos del video: solo MP4/MOV; duración mínima de 3 segundos; resolución 720px-2160px; velocidad de fotogramas 24-60fps (la salida es 24fps); tamaño no superior a 200MB

Sintaxis de referencia de imágenes

El modelo Video O1 utiliza la sintaxis <<<image_N>>> para referenciar imágenes en los prompts, ofreciendo una experiencia unificada text-to-video/image-to-video:
Referencia automática: Si se proporciona image_urls pero el prompt no contiene ninguna referencia <<<image_N>>>, el sistema añadirá automáticamente <<<image_1>>> al principio del prompt.

Respuesta

integer
Código de estado de la respuesta, 200 en caso de éxito
array
Array de datos de la respuesta

Casos de uso

Caso 1: Texto a video (Máxima calidad)

Caso 2: Referencia de imagen (Imagen única)

Caso 3: Múltiples referencias de imagen

Caso 4: Imagen proporcionada sin referencia explícita (añadida automáticamente)

El sistema añadirá automáticamente <<<image_1>>> al principio del prompt, equivalente a "<<<image_1>>>The person slowly turns and smiles".
Consultar los resultados de la tareaLa generación de video es una tarea asíncrona que devuelve un task_id al enviarse. Use el endpoint Obtener estado de la tarea para consultar el progreso y los resultados de la generación.