Gemini Omni 視頻

gemini-omni-flash-preview 經 Interactions 接口同步返回 3-10 秒 720p MP4,按 Token 計費而不是按秒。

gemini-omni-flash-preview 是唯一能出視頻的 Gemini 模型。與 HopBase 上其他視頻模型都不同,它是同步的:一次請求就在響應體裡返回成片,MP4 以 base64 形式給出,沒有任務 ID,也不需要輪詢。

端點

POST https://api.hop-base.com/v1beta/interactions

POST /v1/interactionsPOST /interactions 是等價別名,行為完全一致。

Chat Completions 拿不到視頻

gemini-omni-flash-preview 發給 /v1/chat/completions 是能調通的,但只會返回回答裡的文本部分,視頻塊會被丟棄。要拿成片就用 Interactions 端點。

請求

只有 modelinput 是必填。input 可以是純字符串,也可以是原生的步驟數組;system_instructiongeneration_config 等其他原生字段原樣透傳。

curl https://api.hop-base.com/v1beta/interactions \
  -H "Authorization: Bearer sk-your-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-omni-flash-preview",
    "input": "生成一段 3 秒視頻:白色背景上一顆紅球緩慢滾動"
  }'

沒有 durationresolutionfps 這類參數,想要多長直接在提示詞裡說。

支持文本、圖片、視頻輸入。素材可以用 data 傳 base64 並帶上 mime_type,也可以用遠端 uri。輸入視頻上限 10 秒——網關不校驗這一條,超長由上游拒絕。

輸出

項目取值
時長3-10 秒
分辨率720p
幀率24 FPS
封裝MP4,以 base64 返回
上下文窗口1,048,576 Token

成片在 typemodel_output 那一步的 steps[].content[] 裡:

{
  "status": "completed",
  "model": "gemini-omni-flash-preview",
  "steps": [{
    "type": "model_output",
    "content": [{ "type": "video", "mime_type": "video/mp4", "data": "<base64-mp4>" }]
  }],
  "usage": {
    "total_input_tokens": 20,
    "total_output_tokens": 17819,
    "output_tokens_by_modality": [{ "modality": "video", "tokens": 17376 }]
  }
}

整個 MP4 都在 JSON 響應體裡,所以響應會很大,客戶端緩衝區要留夠。

超時與限制

視頻生成慢,而這個端點沒有異步模式——Prefer: respond-async 對 Gemini 生圖有效,對這裡無效。

  • 客戶端超時要設得足夠長,網關對原生端點給到五分鐘。
  • 經 CDN 轉發的請求可能在 100 秒附近被切斷。該端點在等待期間不發任何保活流量,所以一次長生成有可能表現為網關超時,而請求本身並沒有問題。
  • 超時的請求不上報用量,因此不計費
  • HopBase 在這條路徑上刻意不重試 504:結果未知就重放,有可能把片子生成兩次、也付兩次錢。

模型 ID 帶 preview,能力與可用性可能隨時變更。

分組

Omni 視頻由 Gemini 官方直連分組提供,與 Gemini 對話、Gemini 生圖是同一個分組、同一把密鑰,不需要另買視頻套餐。可用性以 GET /v1/models 為準,實際單價見登錄後的模型廣場

價格

官方牌價見價格頁。你的實際單價以登入後的模型廣場為準,每次請求的實際扣費見用量記錄。

本頁目錄