Skip to content
上新GPT-6 Astra 已上线:OpenAI 新一代旗舰,官方牌价接入($10 / $50 每百万 token,缓存读 $1),Codex CLI 直接可用查看模型价格
HopBase
← 返回博客

GPT-6 Astra API 上线:官方牌价 $10 / $50,Codex CLI 直连 | HopBase

GPT-6 Astra API 上线:官方牌价 $10 / $50,Codex CLI 直连 | HopBase

OpenAI 新一代旗舰 GPT-6 Astra(模型 ID gpt-6-astra)已经上线 HopBase,Codex PlusCodex Pro 分组即刻可用,已有 Key 的用户把模型名换掉即可调用。

怎么调用

  • Responses 与 Chat Completions 双端点原生/v1/responses/v1/chat/completions 都直接支持,OpenAI SDK 零改造。
  • Codex CLI 直连:把模型名换成 gpt-6-astra 即可,不需要改 base URL 或认证方式。
  • 分阶段放量:OpenAI 对 GPT-6 仍在分批开放,各分组的实际可用性以 GET /v1/models 返回为准 —— 调用前先查一次,比撞 404 省事。

价格:按官方牌价接入

项目(每百万 token)GPT-6 AstraGPT-5.6 Sol
输入$10$5
缓存命中读取$1$0.50
输出$50$30

缓存命中读取只要输入价的十分之一,Agent 循环、长会话这类反复读同一前缀的负载省得最多。结算按「牌价 × 实际用量」,控制台实时可查;企业用量请通过价格页联系商务报价。

使用建议:优先用流式

实测下来,流式调用(stream=true)首字稳定在 2–4 秒;而非流式请求当前在上游侧的响应时间波动很大(2 秒到 2 分钟不等),长尾请求有可能撞上 CDN 边缘超时。

对话、Agent、Codex 这类场景本来就走流式,不受影响;如果你的服务端封装了非流式调用,建议这段时间先切成流式再在自己这侧聚合。我们会持续跟进上游表现。

三分钟接入

curl https://api.hop-base.com/v1/responses \
  -H "Authorization: Bearer sk-your-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "input": "你好,介绍一下你自己",
    "stream": true
  }'

Chat Completions 与 Codex CLI 的完整接入步骤见 模型参考文档。已有 Key 的用户把模型名换成 gpt-6-astra 就能开始用。

常见问题

GPT-6 Astra 现在能直接调用吗?

可以。当前已在 Codex Plus 与 Codex Pro 分组开放,已有 Key 的用户把模型名换成 gpt-6-astra 即可。OpenAI 仍在分阶段放量,其他分组的可用性以 GET /v1/models 返回为准,调用前先查一次。

GPT-6 Astra 的价格是多少?

按官方牌价接入:每百万 token 输入 $10、缓存命中读取 $1、输出 $50。结算按牌价乘实际用量,控制台按请求给出分项成本。企业用量请通过价格页联系商务报价。

支持哪些端点和工具?

Responses(/v1/responses)与 Chat Completions(/v1/chat/completions)两个端点都原生支持,OpenAI SDK 零改造。Codex CLI 只需把模型名换掉,不用改 base URL 或认证方式。

为什么建议用流式调用?

2026-09-05 在生产链路上实测,流式首字延迟稳定在 1.5–3.6 秒;而非流式请求在上游侧的响应时间波动很大,长尾请求可能撞上 CDN 边缘超时。对话、Agent、Codex 这类场景本来就走流式,不受影响;服务端封装了非流式调用的,建议这段时间先切成流式再在自己这侧聚合。

和 GPT-5.6、Claude Fable 5.1 比该怎么选?

与 GPT-5.6 的价格延迟对比和按失败成本选型的方法见GPT-6 Astra vs GPT-5.6;与 Claude Fable 5.1 牌价相同、差别在缓存与协议,对比见同价不同账

企业接入评估与模型选型对照测试,联系顾问;接入方式见文档