Nano Banana 2.1(模型 ID gemini-nano-banana-2.1)已經上線 HopBase。這是 Google 最新一代的高效生圖 / 改圖模型,官方給出的三個改進方向是畫面品質、文字排版和多輪編輯的一致性。對接入方來說,最直接的變化有兩個:單張價格約為上一代 Nano Banana 2 的一半(1K 每張 $0.0336),以及原生 4K 輸出。綁定「Gemini 全系(含生圖)」或「Gemini 官方直連」分組的金鑰即刻可用,Base URL 仍是 https://api.hop-base.com。
相比 Nano Banana 2 變了什麼
| 對比項 | Nano Banana 2gemini-3.1-flash-image | Nano Banana 2.1gemini-nano-banana-2.1 |
|---|---|---|
| 1K 每張 | $0.0672 | $0.0336(一半) |
| 2K 每張 | $0.0672 | $0.0504 |
| 4K | 不支援(最高 2K) | $0.113 每張 |
| 圖像輸出單價 | $60 / 百萬 token | $30 / 百萬 token |
| 輸入單價 | $0.50 / 百萬 token | $1.50 / 百萬 token |
價格下降主要來自圖像輸出單價減半;輸入單價反而上調了,所以大量參考圖的改圖請求省得沒有文生圖那麼多——參考圖越多、越大,輸入佔比越高。純文生圖和少量參考圖的場景,基本可以按「每張便宜一半」來估。
價格(官方價)
| 計費項 | 官方價 |
|---|---|
| 輸入(文字 / 圖片) | $1.50 / 百萬 token |
| 文字與思考輸出 | $7.50 / 百萬 token |
| 圖像輸出 | $30 / 百萬 token |
| 快取讀取 | $0.075 / 百萬 token |
| 單張 1K / 2K / 4K | $0.0336 / $0.0504 / $0.113 |
以上為 Google 官方價。實際單價以你所在分組為準,登入後在模型廣場可查,控制台使用紀錄按請求列出每一筆的扣費。
尺寸、比例與速度
- 三檔尺寸:1K、2K、4K。4K 實測 16:9 輸出 5504 × 3072。
- 10 種官方寬高比:
1:1、2:3、3:2、3:4、4:3、4:5、5:4、9:16、16:9、21:9。 - 參考耗時(服務端實測):1K 約 10~15 秒,2K 約 20 秒,4K 約 30~57 秒。
出 2K / 4K 大圖時建議加請求標頭 Prefer: respond-async 走非同步任務,立即拿到 task_id 再用 GET /v1/images/tasks?task_id=… 輪詢,避免長連線被用戶端或中間網路逾時切斷。
三分鐘接入
1. curl:文生圖(指定比例與檔位)
curl https://api.hop-base.com/v1/images/generations \
-H "Authorization: Bearer sk-你的金鑰" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-nano-banana-2.1",
"prompt": "咖啡店新品海報,標題文字「秋日拿鐵」,暖色調,雜誌排版",
"google": {
"image_config": { "aspect_ratio": "3:4", "image_size": "2K" }
}
}' \
| jq -r '.data[0].b64_json' | base64 --decode > result.png
image_config 也可以寫成頂層扁平的 "aspect_ratio" / "image_size",效果相同。只傳 size(如 "2048x1152")時,閘道會對應到最接近的官方比例,並按長邊推導檔位。
2. OpenAI Python SDK
import base64
from openai import OpenAI
client = OpenAI(
base_url="https://api.hop-base.com/v1",
api_key="sk-你的金鑰",
)
resp = client.images.generate(
model="gemini-nano-banana-2.1",
prompt="雨夜霓虹街角的便利商店,招牌寫著 OPEN 24H,電影感",
extra_body={
"google": {
"image_config": {"aspect_ratio": "16:9", "image_size": "4K"}
}
},
)
item = resp.data[0]
# 回傳可能是 JPEG,按 mime_type 選副檔名
ext = "jpg" if getattr(item, "mime_type", "") == "image/jpeg" else "png"
with open(f"result.{ext}", "wb") as f:
f.write(base64.b64decode(item.b64_json))
3. Chat Completions 裡直接出圖
Cherry Studio 這類只會呼叫對話介面的用戶端,可以直接把模型選成 gemini-nano-banana-2.1,圖片以 markdown 內嵌 data URL 回傳:
curl https://api.hop-base.com/v1/chat/completions \
-H "Authorization: Bearer sk-你的金鑰" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-nano-banana-2.1",
"messages": [
{"role": "user", "content": "畫一隻戴圍巾的柴犬,水彩風格"}
]
}'
要精確控制比例和檔位,建議用上面的 Images 介面。
改圖:參考圖編輯
兩個分組都可以在 /v1/images/generations 的 image / images 欄位裡傳參考圖(URL 或 Data URL)。「Gemini 全系(含生圖)」分組另外提供 OpenAI 相容的 /v1/images/edits,可直接上傳本機檔案:
curl https://api.hop-base.com/v1/images/edits \
-H "Authorization: Bearer sk-你的金鑰" \
-F "model=gemini-nano-banana-2.1" \
-F "prompt=把杯子換成第二張圖的配色,其餘保持不變" \
-F "image[][email protected]" \
-F "image[][email protected]" \
-F "aspect_ratio=1:1" \
-F "image_size=2K"
兩個分組怎麼選
| 分組 | 可用端點 |
|---|---|
| Gemini 全系(含生圖) | /v1/images/generations、/v1/images/edits、/v1/chat/completions |
| Gemini 官方直連 | /v1/images/generations、/v1/chat/completions(改圖請在 generations 裡帶參考圖) |
兩個分組都按官方價乘以所在分組的折扣計費,各分組折扣以控制台模型廣場為準。付費請求前請用實際金鑰呼叫一次 GET /v1/models,確認回傳裡有 gemini-nano-banana-2.1。
適合哪些場景
- 批量出圖:電商主圖、社群配圖、A/B 素材,單張成本減半,量大時差別明顯。
- 帶文字的設計稿:海報、封面、資訊卡——文字排版是這一代的重點改進方向,仍建議出圖後人工核對文字。
- 多輪改圖:在上一張結果上連續調整局部,官方強調了多輪編輯的一致性。
- 高清交付:需要 4K 印刷級或大螢幕素材時,不必再換到更貴的型號。
常見問題
和 Nano Banana 2 的呼叫方式一樣嗎?
一樣。請求結構、參數與回傳格式都不變,把 model 換成 gemini-nano-banana-2.1 即可;如果原本受限於 2K,現在可以把 image_size 設為 4K。
能一次出多張嗎?
可以用 n 一次請求多張,閘道並行生成;全有或全無,任一張失敗整個請求不計費。4K 等大尺寸下 n 的上限更低,超出會直接回傳 400。
支援透明背景或 mask 局部重繪嗎?
不支援。background: "transparent" 與 mask 都會回傳 400;局部修改請在提示詞裡描述區域。
失敗會計費嗎?
參數校驗不通過、生成失敗都不計費。只有成功交付圖片的請求才扣費,同步回應的 usage.cost_usd 會列出這一筆的實際扣費。
結果是什麼格式?
Images 介面同步回傳 data[].b64_json,可能是 JPEG,儲存前請看 data[].mime_type;非同步任務完成後回傳圖片位址,請盡快下載到自己的儲存空間。