先說答案:Claude Opus 5.5 與 GPT-6 Sol、GPT-6 Luna 已在 HopBase 上線,按官方牌價接入。Opus 5.5(claude-opus-5-5)是 Anthropic 新一代 Opus:1M 上下文、128K 最大輸出,每百萬 token 輸入 $4 / 輸出 $20,比 Opus 5 的 $5 / $25 便宜 20%,快取命中 $0.20。GPT-6 Sol(gpt-6-sol)面向複雜編碼與 agent 工作流,1.05M 上下文,$2 / $10,快取輸入 $0.2;GPT-6 Luna(gpt-6-luna)面向高吞吐、高價效比場景,同樣 1.05M 上下文,$0.1 / $0.5,快取輸入 $0.01。兩款 GPT-6 在 272K token 以上按長上下文單價計(Sol $4 / $15,Luna $0.2 / $0.75)。選型一句話:Claude Code 與重度 agent 用 Opus 5.5;Codex 與編碼 agent 用 Sol;分類、抽取、路由這類大批次任務用 Luna;最難的問題再上 GPT-6 Astra。可用模型以你那把 Key 的 GET /v1/models 為準。
三款新模型的公開牌價
| 模型 ID | 定位 | 上下文 | 輸入 / 輸出(每百萬 token) | 快取讀取 |
|---|---|---|---|---|
claude-opus-5-5 | Anthropic 新一代 Opus | 1M(最大輸出 128K) | $4 / $20 | $0.20 |
gpt-6-sol | 複雜編碼與 agent 工作流 | 1.05M | $2 / $10(272K 以上 $4 / $15) | $0.2 |
gpt-6-luna | 高吞吐、高價效比 | 1.05M | $0.1 / $0.5(272K 以上 $0.2 / $0.75) | $0.01 |
作為參照:同線上上的 GPT-6 Astra 是 $10 / $50(快取 $1),Claude Opus 5 是 $5 / $25。Opus 5.5 的快取寫入是 5 分鐘 TTL 每百萬 $5、1 小時 TTL 每百萬 $8。以上都是官方牌價;你的實際單價取決於所在分組,以登入後的模型廣場為準,每次請求的扣費在使用記錄裡逐筆可查。
同一個請求,四款模型各花多少
按上表牌價直接算:一次 20K token 輸入、2K token 輸出、沒有命中快取的請求——
- GPT-6 Luna:20K × $0.1/M + 2K × $0.5/M ≈ $0.003
- GPT-6 Sol:20K × $2/M + 2K × $10/M ≈ $0.06
- Claude Opus 5.5:20K × $4/M + 2K × $20/M ≈ $0.12
- GPT-6 Astra:20K × $10/M + 2K × $50/M ≈ $0.30
Luna 和 Astra 之間差了約 100 倍。這正是選型要按任務分層的原因:同一個產品裡,意圖識別、欄位抽取這類每天幾十萬次的呼叫用 Luna,真正需要長鏈推理的少量請求再交給 Sol、Opus 5.5 或 Astra。HopBase 一把 Key 對應一個分組,不同檔位放在不同的 Key 上,成本也就天然按用途分開了。
怎麼選
- Claude Code、重度工具呼叫的 agent:Opus 5.5。價格比 Opus 5 低 20%,快取命中只要 $0.20,長會話裡系統提示與工具定義反覆命中快取,命中佔比越高越划算。
- Codex CLI、編碼 agent、複雜工作流:GPT-6 Sol。$2 / $10 的價位上給到 1.05M 上下文,適合整倉程式碼進上下文的場景;注意超過 272K 後按長上下文單價計。
- 高併發批次任務:GPT-6 Luna。分類、打標、抽取、改寫、路由判斷,量大、單次簡單,用 Luna 能把單次成本壓到零點幾美分。
- 最難、最貴得起的問題:GPT-6 Astra。先用 Sol 或 Opus 5.5 跑,失敗或質量不夠的再升級,比一律用旗艦划算得多。
最可靠的辦法仍然是用你自己的評測集把候選模型各跑一遍,比較結果質量和使用記錄裡的實扣金額,而不是隻看榜單。順便確認你調到的就是你付費的那個模型:可以用API 中轉保真檢測方法自己測。
三分鐘接入
Claude 走 Anthropic 協議,Base URL 是 https://api.hop-base.com(不帶 /v1);GPT 走 OpenAI 相容協議,Base URL 是 https://api.hop-base.com/v1。兩類模型在不同分組,需要各自分組的 Key。
# 先確認這把 Key 能調哪些模型
curl https://api.hop-base.com/v1/models -H "Authorization: Bearer $HOPBASE_OPENAI_API_KEY"
# Claude Opus 5.5(Anthropic 協議)
curl https://api.hop-base.com/v1/messages \
-H "x-api-key: $HOPBASE_CLAUDE_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{"model":"claude-opus-5-5","max_tokens":64,"messages":[{"role":"user","content":"Reply with exactly: ok"}]}'
# GPT-6 Sol / Luna(OpenAI 相容協議;把 model 換成 gpt-6-luna 即可)
curl https://api.hop-base.com/v1/chat/completions \
-H "Authorization: Bearer $HOPBASE_OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"gpt-6-sol","messages":[{"role":"user","content":"Reply with exactly: ok"}]}'
Claude Code 使用者把 ANTHROPIC_BASE_URL 設為 https://api.hop-base.com、ANTHROPIC_AUTH_TOKEN 設為 Claude 分組的 Key,再把模型切到 claude-opus-5-5;Codex CLI 使用者用 Responses 介面(wire_api = "responses"),模型填 gpt-6-sol。
常見問題
Opus 5.5 比 Opus 5 便宜多少?
按官方牌價,輸入從 $5 降到 $4、輸出從 $25 降到 $20,都是 20%;快取命中 $0.20,是輸入價的 0.05 倍。Opus 5.5 上下文 1M,最大輸出 128K。
GPT-6 Sol 和 Luna 的 272K 是什麼意思?
兩款模型上下文都是 1.05M,但超過 272K token 後按長上下文單價計:Sol 為 $4 / $15,Luna 為 $0.2 / $0.75。日常請求在 272K 以內,按基礎價 $2 / $10 與 $0.1 / $0.5 計。
我的 Key 能直接調這三個模型嗎?
取決於 Key 所在分組。Claude 模型需要 Claude 分組的 Key,GPT 模型需要 OpenAI / Codex 分組的 Key。用這把 Key 調 GET /v1/models,返回裡有哪個 ID 就能調哪個,不要猜型號名。
價格就是上面這些嗎?
上面是官方牌價,也是價格頁公佈的基準。企業客戶的實際單價按分組報價,登入後的模型廣場顯示你那把 Key 的實際單價,每次請求的扣費都能在使用記錄裡逐筆核對。