Gemini Omni 視頻
gemini-omni-flash-preview 經 Interactions 接口同步返回 3-10 秒 720p MP4,按 Token 計費而不是按秒。
gemini-omni-flash-preview 是唯一能出視頻的 Gemini 模型。與 HopBase 上其他視頻模型都不同,它是同步的:一次請求就在響應體裡返回成片,MP4 以 base64 形式給出,沒有任務 ID,也不需要輪詢。
端點
POST https://api.hop-base.com/v1beta/interactionsPOST /v1/interactions 與 POST /interactions 是等價別名,行為完全一致。
Chat Completions 拿不到視頻
把 gemini-omni-flash-preview 發給 /v1/chat/completions 是能調通的,但只會返回回答裡的文本部分,視頻塊會被丟棄。要拿成片就用 Interactions 端點。
請求
只有 model 與 input 是必填。input 可以是純字符串,也可以是原生的步驟數組;system_instruction、generation_config 等其他原生字段原樣透傳。
curl https://api.hop-base.com/v1beta/interactions \
-H "Authorization: Bearer sk-your-key" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-omni-flash-preview",
"input": "生成一段 3 秒視頻:白色背景上一顆紅球緩慢滾動"
}'沒有 duration、resolution、fps 這類參數,想要多長直接在提示詞裡說。
支持文本、圖片、視頻輸入。素材可以用 data 傳 base64 並帶上 mime_type,也可以用遠端 uri。輸入視頻上限 10 秒——網關不校驗這一條,超長由上游拒絕。
輸出
| 項目 | 取值 |
|---|---|
| 時長 | 3-10 秒 |
| 分辨率 | 720p |
| 幀率 | 24 FPS |
| 封裝 | MP4,以 base64 返回 |
| 上下文窗口 | 1,048,576 Token |
成片在 type 為 model_output 那一步的 steps[].content[] 裡:
{
"status": "completed",
"model": "gemini-omni-flash-preview",
"steps": [{
"type": "model_output",
"content": [{ "type": "video", "mime_type": "video/mp4", "data": "<base64-mp4>" }]
}],
"usage": {
"total_input_tokens": 20,
"total_output_tokens": 17819,
"output_tokens_by_modality": [{ "modality": "video", "tokens": 17376 }]
}
}整個 MP4 都在 JSON 響應體裡,所以響應會很大,客戶端緩衝區要留夠。
超時與限制
視頻生成慢,而這個端點沒有異步模式——Prefer: respond-async 對 Gemini 生圖有效,對這裡無效。
- 客戶端超時要設得足夠長,網關對原生端點給到五分鐘。
- 經 CDN 轉發的請求可能在 100 秒附近被切斷。該端點在等待期間不發任何保活流量,所以一次長生成有可能表現為網關超時,而請求本身並沒有問題。
- 超時的請求不上報用量,因此不計費。
- HopBase 在這條路徑上刻意不重試 504:結果未知就重放,有可能把片子生成兩次、也付兩次錢。
模型 ID 帶 preview,能力與可用性可能隨時變更。
分組
Omni 視頻由 Gemini 官方直連分組提供,與 Gemini 對話、Gemini 生圖是同一個分組、同一把密鑰,不需要另買視頻套餐。可用性以 GET /v1/models 為準,實際單價見登錄後的模型廣場。