Skip to content
上新GPT-6 Astra 已上線:OpenAI 新一代旗艦,官方牌價接入($10 / $50 每百萬 token,緩存讀 $1),Codex CLI 直接可用查看模型價格
HopBase
← 返回 Blog

GPT-6 Astra API 上線:官方牌價 $10 / $50,Codex CLI 直連 | HopBase

GPT-6 Astra API 上線:官方牌價 $10 / $50,Codex CLI 直連 | HopBase

OpenAI 新一代旗艦 GPT-6 Astra(模型 ID gpt-6-astra)已經上線 HopBase,Codex PlusCodex Pro 分組即刻可用,已有 Key 的用戶把模型名換掉即可呼叫。

怎麼呼叫

  • Responses 與 Chat Completions 雙端點原生/v1/responses/v1/chat/completions 都直接支援,OpenAI SDK 零改造。
  • Codex CLI 直連:把模型名換成 gpt-6-astra 即可,不需要改 base URL 或認證方式。
  • 分階段放量:OpenAI 對 GPT-6 仍在分批開放,各分組的實際可用性以 GET /v1/models 回傳為準 —— 呼叫前先查一次,比撞 404 省事。

價格:按官方牌價接入

項目(每百萬 token)GPT-6 AstraGPT-5.6 Sol
輸入$10$5
快取命中讀取$1$0.50
輸出$50$30

快取命中讀取只要輸入價的十分之一,Agent 迴圈、長對話這類反覆讀同一前綴的負載省得最多。結算按「牌價 × 實際用量」,主控台即時可查;企業用量請透過價格頁聯絡商務報價。

使用建議:優先用串流

實測下來,串流呼叫(stream=true)首字穩定在 2–4 秒;而非串流請求目前在上游側的回應時間波動很大(2 秒到 2 分鐘不等),長尾請求有可能撞上 CDN 邊緣逾時。

對話、Agent、Codex 這類場景本來就走串流,不受影響;如果你的伺服端封裝了非串流呼叫,建議這段時間先切成串流再在自己這側彙整。我們會持續跟進上游表現。

三分鐘接入

curl https://api.hop-base.com/v1/responses \
  -H "Authorization: Bearer sk-your-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "input": "你好,介紹一下你自己",
    "stream": true
  }'

Chat Completions 與 Codex CLI 的完整接入步驟見 模型參考文件。已有 Key 的用戶把模型名換成 gpt-6-astra 就能開始用。

常見問題

GPT-6 Astra 現在能直接呼叫嗎?

可以。目前已在 Codex Plus 與 Codex Pro 分組開放,已有 Key 的用戶把模型名換成 gpt-6-astra 即可。OpenAI 仍在分階段放量,其他分組的可用性以 GET /v1/models 回傳為準,呼叫前先查一次。

GPT-6 Astra 的價格是多少?

按官方牌價接入:每百萬 token 輸入 $10、快取命中讀取 $1、輸出 $50。結算按牌價乘實際用量,主控台按請求給出分項成本。企業用量請透過價格頁聯絡商務報價。

支援哪些端點和工具?

Responses(/v1/responses)與 Chat Completions(/v1/chat/completions)兩個端點都原生支援,OpenAI SDK 零改造。Codex CLI 只需把模型名換掉,不用改 base URL 或認證方式。

為什麼建議用串流呼叫?

2026-09-05 在生產鏈路上實測,串流首字延遲穩定在 1.5–3.6 秒;而非串流請求在上游側的回應時間波動很大,長尾請求可能撞上 CDN 邊緣逾時。對話、Agent、Codex 這類場景本來就走串流,不受影響;伺服端封裝了非串流呼叫的,建議這段時間先切成串流再在自己這側彙整。

和 GPT-5.6、Claude Fable 5.1 比該怎麼選?

與 GPT-5.6 的價格延遲對比和按失敗成本選型的方法見GPT-6 Astra vs GPT-5.6;與 Claude Fable 5.1 牌價相同、差別在快取與協定,對比見同價不同帳

企業接入評估與模型選型對照測試,聯絡顧問;接入方式見文件