OpenAI 新一代旗艦 GPT-6 Astra(模型 ID gpt-6-astra)已經上線 HopBase,Codex Plus 與 Codex Pro 分組即刻可用,已有 Key 的用戶把模型名換掉即可呼叫。
怎麼呼叫
- Responses 與 Chat Completions 雙端點原生:
/v1/responses和/v1/chat/completions都直接支援,OpenAI SDK 零改造。 - Codex CLI 直連:把模型名換成
gpt-6-astra即可,不需要改 base URL 或認證方式。 - 分階段放量:OpenAI 對 GPT-6 仍在分批開放,各分組的實際可用性以
GET /v1/models回傳為準 —— 呼叫前先查一次,比撞 404 省事。
價格:按官方牌價接入
| 項目(每百萬 token) | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|
| 輸入 | $10 | $5 |
| 快取命中讀取 | $1 | $0.50 |
| 輸出 | $50 | $30 |
快取命中讀取只要輸入價的十分之一,Agent 迴圈、長對話這類反覆讀同一前綴的負載省得最多。結算按「牌價 × 實際用量」,主控台即時可查;企業用量請透過價格頁聯絡商務報價。
使用建議:優先用串流
實測下來,串流呼叫(stream=true)首字穩定在 2–4 秒;而非串流請求目前在上游側的回應時間波動很大(2 秒到 2 分鐘不等),長尾請求有可能撞上 CDN 邊緣逾時。
對話、Agent、Codex 這類場景本來就走串流,不受影響;如果你的伺服端封裝了非串流呼叫,建議這段時間先切成串流再在自己這側彙整。我們會持續跟進上游表現。
三分鐘接入
curl https://api.hop-base.com/v1/responses \
-H "Authorization: Bearer sk-your-key" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"input": "你好,介紹一下你自己",
"stream": true
}'
Chat Completions 與 Codex CLI 的完整接入步驟見 模型參考文件。已有 Key 的用戶把模型名換成 gpt-6-astra 就能開始用。