Wan2.6
Generación de Video Wan2.6
- Modelo de generación de video Wanxiang de Alibaba Cloud
- Soporta Text-to-Video e Image-to-Video
- Soporta resolución 720p/1080p, duración de 5/10/15 segundos
- Soporta extensión automática del prompt y generación de audio
POST
Autorización
string
requerido
Todos los endpoints de la API requieren autenticación mediante Bearer TokenObtenga su API Key:Visite la página de gestión de API Keys para obtener su API KeyAñádala al encabezado de la solicitud:
Parámetros de la solicitud
string
requerido
Nombre del modelo de generación de video, fijado como
wan2.6boolean
predeterminado:"false"
Indica si se debe moderar el contenido antes de enviar la tarea de vídeo.
true: revisar los prompts y las imágenes de entrada conomni-moderation-latestfalseu omitido: no enviar una solicitud de moderación, sin coste ni latencia de moderación adicionales (predeterminado)
string
requerido
Descripción del contenido del videoRequerido para el modo text-to-video. Describa escenas, acciones y estilos en detalle para obtener mejores resultadosEjemplo:
"A cute cat stretching in the sunlight"array<url>
Array de URLs de imágenes de referencia (solo se admite 1 imagen)Requerido para el modo image-to-video. Admite URLs de imágenes accesibles públicamenteEjemplo:
["https://example.com/image.jpg"]El sistema selecciona automáticamente el modo text-to-video o image-to-video según si se incluye
image_urlsstring
Prompt negativo que describe contenido no deseadoEjemplo:
"blurry, low quality, distorted"string
predeterminado:"16:9"
Proporción de aspecto del videoOpciones:
16:9- Paisaje (por defecto)9:16- Retrato1:1- Cuadrado4:3- Paisaje3:4- Retrato
16:9string
predeterminado:"720p"
Resolución del videoOpciones:
720p- Estándar (por defecto)1080p- Alta definición
720pFacturado por segundo. El precio varía según la resolución. Consulte el marketplace de modelos para conocer los precios específicos
integer
predeterminado:"5"
Duración del video (segundos)Valores soportados:
5, 10, 15 segundos únicamentePor defecto: 5integer
Semilla aleatoria para resultados reproduciblesEjemplo:
12345boolean
Si se debe extender automáticamente el promptCuando está activado, el sistema optimizará y enriquecerá automáticamente su prompt
boolean
Si se debe añadir audio automáticamenteCuando está activado, el sistema generará audio que coincida con el video
string
URL de audio especificadaTiene prioridad sobre el parámetro
audiostring
Tipo de tomaOpciones:
single- Toma únicamulti- Múltiples tomas
boolean
Si se debe añadir una marca de agua
string
Nombre de la plantilla de efecto para el modo de efectos especiales image-to-videoEfectos generales:
Al usar el modo de efectos:
- Solo se requiere una imagen (pasada mediante
image_urls) - No se necesita prompt (el modelo ignora el campo
prompt)
squish- Squish & Squeezerotation- Rotaciónpoke- Pincharinflate- Inflado de globodissolve- Disolución molecularmelt- Derretimiento por ola de caloricecream- Planeta heladoflying- Levitación mágica
carousel- Carrusel del tiemposingleheart- Te amodance1- Momento swingdance2- Movimiento de baile
Combinaciones de resolución y proporción de aspecto
Respuesta
integer
Código de estado de la respuesta, 200 en caso de éxito
array
Array de datos de la respuesta
Casos de uso
Caso 1: Texto a video (Solicitud simple)
Caso 2: Texto a video (Parámetros completos)
Caso 3: Imagen a video
Caso 4: Imagen a video (Imagen Base64)
Descripción de modos
Texto a video (Text-to-Video)
- El parámetro
promptes obligatorio - El parámetro
image_urlsno es necesario
Imagen a video (Image-to-Video)
- El parámetro
image_urlses obligatorio (solo se admite 1 imagen) - El parámetro
promptes opcional, se usa para describir las acciones esperadas
El sistema selecciona automáticamente el modo según si se incluye
image_urls en la solicitudConsultar resultados de la tareaLa generación de video es una tarea asíncrona que devuelve un
task_id al enviarse. Use el endpoint Obtener estado de la tarea para consultar el progreso y los resultados de la generación.