Video de Gemini Omni

gemini-omni-flash-preview devuelve un MP4 de 720p y 3-10 segundos de forma síncrona mediante la API de Interactions, facturado por token y no por segundo.

gemini-omni-flash-preview es el único modelo de Gemini que produce video. A diferencia de los demás modelos de video de HopBase, es síncrono: una sola solicitud devuelve el clip terminado como MP4 en base64 dentro del cuerpo de la respuesta. No hay ID de tarea ni sondeo.

Endpoint

POST https://api.hop-base.com/v1beta/interactions

POST /v1/interactions y POST /interactions se aceptan como alias y se comportan igual.

Chat Completions no puede devolver el video

Enviar gemini-omni-flash-preview a /v1/chat/completions funciona, pero solo vuelve la parte de texto de la respuesta: el bloque de video se descarta. Use el endpoint de Interactions cuando quiera el clip.

Solicitud

Solo model e input son obligatorios. input acepta una cadena simple o el arreglo nativo de pasos, y otros campos nativos como system_instruction y generation_config se transmiten sin cambios.

curl https://api.hop-base.com/v1beta/interactions \
  -H "Authorization: Bearer sk-your-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-omni-flash-preview",
    "input": "Genera un video de 3 segundos de una pelota roja rodando lentamente sobre fondo blanco"
  }'

No existen parámetros duration, resolution ni fps. Indique la duración que quiere en el propio prompt.

Se admite entrada de texto, imagen y video. Los medios se envían como base64 en data con su mime_type, o como un uri remoto. El video de entrada está limitado a 10 segundos; la pasarela no lo comprueba, así que es el proveedor quien rechaza un clip demasiado largo.

Salida

PropiedadValor
Duración3-10 segundos
Resolución720p
Cuadros por segundo24 FPS
ContenedorMP4, devuelto en base64
Ventana de contexto1.048.576 tokens

El clip está en steps[].content[], en el paso cuyo type es model_output:

{
  "status": "completed",
  "model": "gemini-omni-flash-preview",
  "steps": [{
    "type": "model_output",
    "content": [{ "type": "video", "mime_type": "video/mp4", "data": "<base64-mp4>" }]
  }],
  "usage": {
    "total_input_tokens": 20,
    "total_output_tokens": 17819,
    "output_tokens_by_modality": [{ "modality": "video", "tokens": 17376 }]
  }
}

Como el MP4 completo llega dentro del cuerpo JSON, las respuestas son grandes. Dimensione los búferes de su cliente en consecuencia.

Tiempos de espera y límites

La generación de video es lenta y este endpoint no tiene modo asíncrono: Prefer: respond-async funciona para la generación de imágenes de Gemini, pero no aquí.

  • Configure un tiempo de espera de cliente generoso. La pasarela concede hasta cinco minutos en el endpoint nativo.
  • Las solicitudes que pasan por una CDN pueden cortarse cerca de los 100 segundos. Este endpoint no envía tráfico de mantenimiento mientras espera, así que una generación larga puede aparecer como un tiempo de espera agotado aunque la solicitud esté bien.
  • Una solicitud que agota el tiempo no informa consumo, así que no se factura.
  • HopBase no reintenta deliberadamente un 504 en esta ruta. Repetir una solicitud cuyo resultado se desconoce arriesgaría generar y pagar el clip dos veces.

El ID del modelo lleva preview. Sus capacidades y disponibilidad pueden cambiar sin aviso.

Grupo

El video de Omni lo sirve el grupo Gemini 官方直连: el mismo grupo y la misma clave que el chat de Gemini y la generación de imágenes de Gemini. No hay que comprar un paquete de video aparte. Confirme la disponibilidad con GET /v1/models y consulte sus tarifas efectivas en el catálogo de modelos con la sesión iniciada.

Tarifas

Los precios de lista oficiales están en la página de precios. Su tarifa es la que aparece en el catálogo de modelos con la sesión iniciada, y el cargo real de cada solicitud está en su registro de uso.

En esta página