OpenAI 新一代旗艦 GPT-6 Astra(模型 ID gpt-6-astra)已經上線 HopBase,Codex Plus 與 Codex Pro 分組即刻可用,已有 Key 的用戶把模型名換掉即可呼叫。
怎麼呼叫
- Responses 與 Chat Completions 雙端點原生:
/v1/responses和/v1/chat/completions都直接支援,OpenAI SDK 零改造。 - Codex CLI 直連:把模型名換成
gpt-6-astra即可,不需要改 base URL 或認證方式。 - 分階段放量:OpenAI 對 GPT-6 仍在分批開放,各分組的實際可用性以
GET /v1/models回傳為準 —— 呼叫前先查一次,比撞 404 省事。
價格:按官方牌價接入
| 項目(每百萬 token) | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|
| 輸入 | $10 | $5 |
| 快取命中讀取 | $1 | $0.50 |
| 輸出 | $50 | $30 |
快取命中讀取只要輸入價的十分之一,Agent 迴圈、長對話這類反覆讀同一前綴的負載省得最多。結算按「牌價 × 實際用量」,主控台即時可查;企業用量請透過價格頁聯絡商務報價。
使用建議:優先用串流
實測下來,串流呼叫(stream=true)首字穩定在 2–4 秒;而非串流請求目前在上游側的回應時間波動很大(2 秒到 2 分鐘不等),長尾請求有可能撞上 CDN 邊緣逾時。
對話、Agent、Codex 這類場景本來就走串流,不受影響;如果你的伺服端封裝了非串流呼叫,建議這段時間先切成串流再在自己這側彙整。我們會持續跟進上游表現。
三分鐘接入
curl https://api.hop-base.com/v1/responses \
-H "Authorization: Bearer sk-your-key" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"input": "你好,介紹一下你自己",
"stream": true
}'
Chat Completions 與 Codex CLI 的完整接入步驟見 模型參考文件。已有 Key 的用戶把模型名換成 gpt-6-astra 就能開始用。
常見問題
GPT-6 Astra 現在能直接呼叫嗎?
可以。目前已在 Codex Plus 與 Codex Pro 分組開放,已有 Key 的用戶把模型名換成 gpt-6-astra 即可。OpenAI 仍在分階段放量,其他分組的可用性以 GET /v1/models 回傳為準,呼叫前先查一次。
GPT-6 Astra 的價格是多少?
按官方牌價接入:每百萬 token 輸入 $10、快取命中讀取 $1、輸出 $50。結算按牌價乘實際用量,主控台按請求給出分項成本。企業用量請透過價格頁聯絡商務報價。
支援哪些端點和工具?
Responses(/v1/responses)與 Chat Completions(/v1/chat/completions)兩個端點都原生支援,OpenAI SDK 零改造。Codex CLI 只需把模型名換掉,不用改 base URL 或認證方式。
為什麼建議用串流呼叫?
2026-09-05 在生產鏈路上實測,串流首字延遲穩定在 1.5–3.6 秒;而非串流請求在上游側的回應時間波動很大,長尾請求可能撞上 CDN 邊緣逾時。對話、Agent、Codex 這類場景本來就走串流,不受影響;伺服端封裝了非串流呼叫的,建議這段時間先切成串流再在自己這側彙整。
和 GPT-5.6、Claude Fable 5.1 比該怎麼選?
與 GPT-5.6 的價格延遲對比和按失敗成本選型的方法見GPT-6 Astra vs GPT-5.6;與 Claude Fable 5.1 牌價相同、差別在快取與協定,對比見同價不同帳。