> ## Documentation Index
> Fetch the complete documentation index at: https://docs.apimart.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Generación de video Gemini Omni 1.1 Flash

>  - Modelo oficial de Google Gemini Omni 1.1 Flash para generación de video multimodal todo en uno
- Admite texto a video, imagen a video, referencias de varios sujetos, interpolación del primer y último fotograma, edición y extensión de video
- Admite 360p / 720p / 1080p / 4K, 24 fps y salidas de 3–10 segundos con audio generado
- API de tareas asíncronas; consulta el resultado por ID de tarea después del envío 

<RequestExample>
  ```bash cURL theme={null}
  curl --request POST \
    --url https://api.apimart.ai/v1/videos/generations \
    --header 'Authorization: Bearer <token>' \
    --header 'Content-Type: application/json' \
    --data '{
      "model": "gemini-omni-1.1-flash",
      "prompt": "A marble rolling fast on a chain reaction style track, continuous smooth shot.",
      "aspect_ratio": "16:9",
      "resolution": "1080p"
    }'
  ```

  ```python Python theme={null}
  import requests

  url = "https://api.apimart.ai/v1/videos/generations"

  payload = {
      "model": "gemini-omni-1.1-flash",
      "prompt": "A marble rolling fast on a chain reaction style track, continuous smooth shot.",
      "aspect_ratio": "16:9",
      "resolution": "1080p"
  }

  headers = {
      "Authorization": "Bearer <token>",
      "Content-Type": "application/json"
  }

  response = requests.post(url, json=payload, headers=headers)

  print(response.json())
  ```

  ```javascript JavaScript theme={null}
  const url = "https://api.apimart.ai/v1/videos/generations";

  const payload = {
    model: "gemini-omni-1.1-flash",
    prompt: "A marble rolling fast on a chain reaction style track, continuous smooth shot.",
    aspect_ratio: "16:9",
    resolution: "1080p"
  };

  const headers = {
    "Authorization": "Bearer <token>",
    "Content-Type": "application/json"
  };

  fetch(url, {
    method: "POST",
    headers: headers,
    body: JSON.stringify(payload)
  })
    .then(response => response.json())
    .then(data => console.log(data))
    .catch(error => console.error("Error:", error));
  ```

  ```go Go theme={null}
  package main

  import (
      "bytes"
      "encoding/json"
      "fmt"
      "io/ioutil"
      "net/http"
  )

  func main() {
      url := "https://api.apimart.ai/v1/videos/generations"

      payload := map[string]interface{}{
          "model":        "gemini-omni-1.1-flash",
          "prompt":       "A marble rolling fast on a chain reaction style track, continuous smooth shot.",
          "aspect_ratio": "16:9",
          "resolution":   "1080p",
      }

      jsonData, _ := json.Marshal(payload)

      req, _ := http.NewRequest("POST", url, bytes.NewBuffer(jsonData))
      req.Header.Set("Authorization", "Bearer <token>")
      req.Header.Set("Content-Type", "application/json")

      client := &http.Client{}
      resp, err := client.Do(req)
      if err != nil {
          panic(err)
      }
      defer resp.Body.Close()

      body, _ := ioutil.ReadAll(resp.Body)
      fmt.Println(string(body))
  }
  ```
</RequestExample>

<ResponseExample>
  ```json 200 theme={null}
  {
    "code": 200,
    "data": [
      {
        "status": "submitted",
        "task_id": "task_01KS1H7ZYSJWH1N779S2FSHTKA"
      }
    ]
  }
  ```

  ```json 400 theme={null}
  {
    "error": {
      "code": 400,
      "message": "Parámetros de solicitud no válidos",
      "type": "invalid_request_error"
    }
  }
  ```

  ```json 401 theme={null}
  {
    "error": {
      "code": 401,
      "message": "Error de autenticación. Comprueba tu clave de API",
      "type": "authentication_error"
    }
  }
  ```

  ```json 402 theme={null}
  {
    "error": {
      "code": 402,
      "message": "Saldo insuficiente. Añade fondos e inténtalo de nuevo",
      "type": "payment_required"
    }
  }
  ```

  ```json 429 theme={null}
  {
    "error": {
      "code": 429,
      "message": "Demasiadas solicitudes. Inténtalo de nuevo más tarde",
      "type": "rate_limit_error"
    }
  }
  ```
</ResponseExample>

## Autenticación

<ParamField header="Authorization" type="string" required>
  Todas las API requieren autenticación mediante Bearer Token.

  Obtener una clave de API:

  Visita la [página de gestión de claves de API](https://apimart.ai/keys) para obtener tu clave.

  Añádela al encabezado de la solicitud:

  ```
  Authorization: Bearer YOUR_API_KEY
  ```
</ParamField>

## Parámetros de solicitud

<ParamField body="model" type="string" required>
  Nombre del modelo de generación de video. Debe ser `gemini-omni-1.1-flash`.
</ParamField>

<ParamField body="prompt" type="string">
  Instrucción de texto. Para texto a video, describe la escena. Para imagen a video, edición o extensión, describe el movimiento, el estilo o el cambio solicitado.

  <Note>
    Proporciona al menos `prompt` o contenido multimedia (`image_urls`, imágenes del primer/último fotograma o `video_urls`).
  </Note>
</ParamField>

<ParamField body="resolution" type="string" default="720p">
  Resolución del video de salida. No distingue entre mayúsculas y minúsculas.

  Valores disponibles:

  * `360p`
  * `720p` (predeterminado)
  * `1080p`
  * `4k`

  `2160p` se trata como `4k`. La resolución determina el nivel del depósito retenido y el coste principal de la salida de video.

  <Warning>
    Una resolución no compatible devuelve el error `invalid_resolution`.
  </Warning>
</ParamField>

<ParamField body="aspect_ratio" type="string" default="16:9">
  Relación de aspecto del video para seleccionar salida horizontal o vertical.

  Compatible:

  * `16:9` - Horizontal (predeterminado)
  * `9:16` - Vertical

  Los demás valores se tratan como `16:9`.

  <Warning>
    Al proporcionar `video_urls`, la salida suele seguir la relación de aspecto del video de entrada, por lo que `aspect_ratio` puede no aplicarse.
  </Warning>
</ParamField>

<ParamField body="image_urls" type="array<string>">
  Array de imágenes de referencia. Solo se admiten URL HTTP/HTTPS de acceso público.

  * Proporcionar 1 imagen: se usa como fotograma inicial del video de forma predeterminada
  * Proporcionar varias imágenes: se usan como referencias de sujetos o estilo; describe la función y relación de cada imagen en `prompt`

  <Warning>
    `image_urls` y las imágenes del primer/último fotograma admiten un máximo total de 10 imágenes.
  </Warning>
</ParamField>

<ParamField body="first_frame_image" type="string">
  Imagen del primer fotograma. Solo se admite una URL HTTP/HTTPS de acceso público.

  * Proporcionada sola: usa la imagen como fotograma inicial del video
  * Proporcionada con `last_frame_image`: genera una transición suave del primer al último fotograma
</ParamField>

<ParamField body="last_frame_image" type="string">
  Imagen del último fotograma. Solo se admite una URL HTTP/HTTPS de acceso público y debe proporcionarse con `first_frame_image`.

  <Warning>
    Proporcionar solo `last_frame_image` devuelve `invalid_frame_images`. Usa la misma relación en ambas imágenes y haz que coincida con `aspect_ratio`.
  </Warning>
</ParamField>

<Note>
  Para un primer fotograma o un par de primer/último fotograma, los siguientes métodos tienen el mismo efecto. **Elige uno y no proporciones ambos**:

  * Usar `first_frame_image` / `last_frame_image`
  * Usar `image_with_roles` con `role` establecido en `first_frame` / `last_frame`
</Note>

<ParamField body="image_with_roles" type="array<object>">
  Array de imágenes con roles. Es una alternativa equivalente a `first_frame_image` / `last_frame_image` y también permite declarar imágenes de referencia.

  <Expandable title="Elemento de image_with_roles">
    <ParamField body="url" type="string" required>
      URL HTTP/HTTPS de imagen de acceso público.
    </ParamField>

    <ParamField body="role" type="string" required>
      Rol de la imagen:

      * `first_frame`: primer fotograma
      * `last_frame`: último fotograma; también debe existir un primer fotograma
      * `reference`: imagen de referencia; los demás roles que no sean primer o último fotograma también se tratan como referencias
    </ParamField>
  </Expandable>

  Ejemplo:

  ```json theme={null}
  [
    {"url": "https://example.com/start.jpg", "role": "first_frame"},
    {"url": "https://example.com/end.jpg", "role": "last_frame"}
  ]
  ```

  <Note>
    Si también se proporciona `image_urls`, este tiene prioridad para las referencias y no se combina con las referencias de `image_with_roles`. Todas las imágenes utilizadas, incluidos los fotogramas inicial y final, están limitadas a 10 en total.
  </Note>
</ParamField>

<ParamField body="video_urls" type="array<string>">
  Array de videos para editar o extender. Actualmente se admite un máximo de un video de hasta 10 segundos.

  Solo se admiten URL directas HTTP/HTTPS de video de acceso público. No se admiten enlaces de YouTube.

  <Warning>
    `video_urls` y `extend_from_task_id` son mutuamente excluyentes. Proporciona solo uno.
  </Warning>
</ParamField>

<ParamField body="metadata" type="object">
  Objeto de parámetros adicionales para indicar explícitamente la intención de generación.

  <Expandable title="Campos de metadata">
    <ParamField body="task" type="string">
      Tipos de tarea disponibles:

      * `text_to_video`: texto a video
      * `image_to_video`: imagen a video
      * `reference_to_video`: referencia a video
      * `edit`: edición de video
      * `extend`: extensión de video

      Si se omite, el sistema deduce la tarea a partir de las entradas y el prompt.
    </ParamField>
  </Expandable>

  <Note>
    Para la interpolación del primer y último fotograma, el modelo deduce la tarea automáticamente y la plataforma no envía `metadata.task`.
  </Note>
</ParamField>

<ParamField body="extend_from_task_id" type="string">
  `task_id` local de la tarea de generación anterior. Úsalo para edición conversacional o extensiones posteriores sin volver a cargar el video anterior.

  La tarea referenciada debe pertenecer al usuario actual, haber finalizado correctamente y usar un modelo Gemini Omni.

  <Warning>
    `extend_from_task_id` y `video_urls` son mutuamente excluyentes. Proporciona solo uno.
  </Warning>
</ParamField>

<Warning>
  Este modelo no tiene el parámetro `duration`. La duración de cada salida se determina automáticamente según el contenido, normalmente entre 3 y 10 segundos. Para controlar el ritmo, descríbelo en `prompt` con lenguaje natural o intervalos de tiempo.
</Warning>

## Respuesta

<ResponseField name="code" type="integer">
  Código de respuesta. `200` indica éxito.
</ResponseField>

<ResponseField name="data" type="array">
  Array de tareas devuelto.

  <Expandable title="Elemento del array">
    <ResponseField name="status" type="string">
      Estado inicial de la tarea. Un envío correcto devuelve `submitted`.
    </ResponseField>

    <ResponseField name="task_id" type="string">
      Identificador único para consultar el estado y el resultado de la tarea.
    </ResponseField>
  </Expandable>
</ResponseField>

## Consultar el resultado de la tarea

La generación de video es asíncrona. Tras recibir el `task_id`, usa la API [Obtener estado de la tarea](/es/api-reference/tasks/status) para consultar el progreso y el resultado.

```bash cURL theme={null}
curl --request GET \
  --url https://api.apimart.ai/v1/tasks/task_01KS1H7ZYSJWH1N779S2FSHTKA \
  --header 'Authorization: Bearer <token>'
```

Consulta cada 5–10 segundos y detente cuando el estado sea `completed` o `failed`. Se recomienda un tiempo de espera total del cliente de 10 minutos.

### Ejemplo de resultado correcto

```json theme={null}
{
  "code": 200,
  "data": {
    "id": "task_01KS1H7ZYSJWH1N779S2FSHTKA",
    "status": "completed",
    "progress": 100,
    "cost": 1.52,
    "credits_cost": 15.2,
    "result": {
      "videos": [
        {
          "url": ["https://cdn.example.com/gemini_omni_xxx.mp4"],
          "expires_at": 1788518400
        }
      ]
    }
  }
}
```

## Casos de uso

### Caso 1: texto a video (4K)

```json theme={null}
{
  "model": "gemini-omni-1.1-flash",
  "prompt": "a blue butterfly landing on a flower, macro, soft light, no dialogue",
  "aspect_ratio": "9:16",
  "resolution": "4k"
}
```

### Caso 2: interpolación del primer y último fotograma

```json theme={null}
{
  "model": "gemini-omni-1.1-flash",
  "prompt": "smooth transition, camera slowly pushes in",
  "first_frame_image": "https://example.com/start.jpg",
  "last_frame_image": "https://example.com/end.jpg",
  "resolution": "720p"
}
```

### Caso 3: referencias de varios sujetos

```json theme={null}
{
  "model": "gemini-omni-1.1-flash",
  "prompt": "the cat playfully bats at the ball of yarn",
  "image_urls": [
    "https://example.com/cat.png",
    "https://example.com/yarn.png"
  ],
  "resolution": "720p"
}
```

### Caso 4: declarar el primer y último fotograma mediante roles de imagen

```json theme={null}
{
  "model": "gemini-omni-1.1-flash",
  "prompt": "a smooth cinematic transition from sunrise to a starry night",
  "image_with_roles": [
    {"url": "https://example.com/sunrise.jpg", "role": "first_frame"},
    {"url": "https://example.com/night.jpg", "role": "last_frame"}
  ],
  "resolution": "1080p"
}
```

### Caso 5: edición de video

```json theme={null}
{
  "model": "gemini-omni-1.1-flash",
  "prompt": "Make the violin invisible. Keep everything else the same.",
  "video_urls": ["https://example.com/clip.mp4"]
}
```

Usa prompts breves y específicos para editar video. Para cambiar solo una parte, añade `Keep everything else the same` y conserva la coherencia del resto.

### Caso 6: extensión conversacional

```json theme={null}
{
  "model": "gemini-omni-1.1-flash",
  "prompt": "Extend this video: the camera pans across the mountains.",
  "extend_from_task_id": "task_01AAA"
}
```
