OpenAI 新一代旗舰 GPT-6 Astra(模型 ID gpt-6-astra)已经上线 HopBase,Codex Plus 与 Codex Pro 分组即刻可用,已有 Key 的用户把模型名换掉即可调用。
怎么调用
- Responses 与 Chat Completions 双端点原生:
/v1/responses和/v1/chat/completions都直接支持,OpenAI SDK 零改造。 - Codex CLI 直连:把模型名换成
gpt-6-astra即可,不需要改 base URL 或认证方式。 - 分阶段放量:OpenAI 对 GPT-6 仍在分批开放,各分组的实际可用性以
GET /v1/models返回为准 —— 调用前先查一次,比撞 404 省事。
价格:按官方牌价接入
| 项目(每百万 token) | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|
| 输入 | $10 | $5 |
| 缓存命中读取 | $1 | $0.50 |
| 输出 | $50 | $30 |
缓存命中读取只要输入价的十分之一,Agent 循环、长会话这类反复读同一前缀的负载省得最多。结算按「牌价 × 实际用量」,控制台实时可查;企业用量请通过价格页联系商务报价。
使用建议:优先用流式
实测下来,流式调用(stream=true)首字稳定在 2–4 秒;而非流式请求当前在上游侧的响应时间波动很大(2 秒到 2 分钟不等),长尾请求有可能撞上 CDN 边缘超时。
对话、Agent、Codex 这类场景本来就走流式,不受影响;如果你的服务端封装了非流式调用,建议这段时间先切成流式再在自己这侧聚合。我们会持续跟进上游表现。
三分钟接入
curl https://api.hop-base.com/v1/responses \
-H "Authorization: Bearer sk-your-key" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"input": "你好,介绍一下你自己",
"stream": true
}'
Chat Completions 与 Codex CLI 的完整接入步骤见 模型参考文档。已有 Key 的用户把模型名换成 gpt-6-astra 就能开始用。
常见问题
GPT-6 Astra 现在能直接调用吗?
可以。当前已在 Codex Plus 与 Codex Pro 分组开放,已有 Key 的用户把模型名换成 gpt-6-astra 即可。OpenAI 仍在分阶段放量,其他分组的可用性以 GET /v1/models 返回为准,调用前先查一次。
GPT-6 Astra 的价格是多少?
按官方牌价接入:每百万 token 输入 $10、缓存命中读取 $1、输出 $50。结算按牌价乘实际用量,控制台按请求给出分项成本。企业用量请通过价格页联系商务报价。
支持哪些端点和工具?
Responses(/v1/responses)与 Chat Completions(/v1/chat/completions)两个端点都原生支持,OpenAI SDK 零改造。Codex CLI 只需把模型名换掉,不用改 base URL 或认证方式。
为什么建议用流式调用?
2026-09-05 在生产链路上实测,流式首字延迟稳定在 1.5–3.6 秒;而非流式请求在上游侧的响应时间波动很大,长尾请求可能撞上 CDN 边缘超时。对话、Agent、Codex 这类场景本来就走流式,不受影响;服务端封装了非流式调用的,建议这段时间先切成流式再在自己这侧聚合。
和 GPT-5.6、Claude Fable 5.1 比该怎么选?
与 GPT-5.6 的价格延迟对比和按失败成本选型的方法见GPT-6 Astra vs GPT-5.6;与 Claude Fable 5.1 牌价相同、差别在缓存与协议,对比见同价不同账。