美國區:DeepSeek 與 GLM
用 OpenAI Chat Completions、OpenAI Responses 或 Anthropic Messages 呼叫美國區的 DeepSeek 與 GLM 模型。
| 項目 | 值 |
|---|---|
| Base URL | https://api.hop-base.com/v1 |
| OpenAI Chat Completions | POST /v1/chat/completions |
| OpenAI Responses | POST /v1/responses |
| Anthropic Messages | POST /v1/messages |
美國區模型是一組獨立的模型 ID,全部以 -us 結尾。每個模型都支援這三種協議,同一把密鑰、同一個模型 ID 通用,依你的客戶端選協議即可。
curl https://api.hop-base.com/v1/chat/completions \
-H "Authorization: Bearer sk-your-key" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4.1-flash-us",
"messages": [{ "role": "user", "content": "用五條重點總結本季的風險。" }]
}'模型
| 模型 ID | 上下文窗口 | 最大輸出 tokens | 圖片輸入 |
|---|---|---|---|
deepseek-v4.1-flash-us | 1M | 393,216 | 支援 |
deepseek-v4-pro-us | 1M | 393,216 | 不支援 |
deepseek-v4-flash-us | 1M | 393,216 | 不支援 |
glm-5.3-us | 1M | 131,072 | 不支援 |
glm-5.2-us | 1M | 131,072 | 不支援 |
DeepSeek 模型在「DeepSeek 美國區」分組,GLM 模型在「GLM 美國區」分組。在控制台「API 金鑰」把分組加進密鑰;不含該分組的密鑰呼叫會回傳 404。建立密鑰的視窗裡,這兩個分組都列在「美國區」分類下。
deepseek-v4-pro-us 是 2026-08-13 發布版,deepseek-v4-flash-us 是 2026-07-31 發布版。不支援圖片輸入的模型看不到圖片:請求照常成功,模型會回答沒有收到圖片。
這些 ID 與 DeepSeek、GLM-5.3 頁面上的模型彼此獨立,限制、價格和協議支援都不同。呼叫 -us 模型以本頁為準。
選擇協議
| 客戶端 | 協議 | 端點 |
|---|---|---|
| OpenAI SDK、Cherry Studio、Cursor、Dify | OpenAI Chat Completions | /v1/chat/completions |
| Codex CLI | OpenAI Responses | /v1/responses |
| Claude Code、Anthropic SDK | Anthropic Messages | /v1/messages |
鑑權用 Authorization: Bearer sk-your-key;在 /v1/messages 上也可以用 x-api-key 請求標頭。所有回應裡的 model 欄位都回顯你請求的 ID。
Claude Code
把 Claude Code 指向 HopBase,再選一個 -us 模型。Claude Code 不認得這些 ID,所以還要告訴它真實的上下文窗口,否則它會在 200K tokens 時壓縮對話。
export ANTHROPIC_BASE_URL="https://api.hop-base.com"
export ANTHROPIC_AUTH_TOKEN="sk-your-key"
export ANTHROPIC_MODEL="deepseek-v4.1-flash-us"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek-v4-flash-us"
export CLAUDE_CODE_MAX_CONTEXT_TOKENS=1000000
claudeANTHROPIC_DEFAULT_HAIKU_MODEL 是 Claude Code 產生標題等背景工作時使用的模型。一鍵設定與 settings.json 寫法見 Claude Code。
Codex CLI
在 ~/.codex/config.toml 加一個 provider,wire_api 設為 responses。
model = "deepseek-v4.1-flash-us"
model_provider = "hopbase"
[model_providers.hopbase]
name = "HopBase"
base_url = "https://api.hop-base.com/v1"
env_key = "HOPBASE_API_KEY"
wire_api = "responses"接著設定環境變數 HOPBASE_API_KEY 並執行 codex。更多選項見 Codex CLI。
思考與工具調用
五個模型預設都會思考。Chat Completions 在 reasoning_content 回傳思考過程,Anthropic Messages 用 thinking 區塊,Responses 用推理項。輸出 tokens 已經包含思考部分。
glm-5.3-us始終思考,關閉思考會回傳 400。- 在 Anthropic Messages 上,GLM 模型的
output_config.effort會對應到low、high或max:medium視為high,xhigh視為max。DeepSeek 原樣接收。 - 函式呼叫完整可用:單次呼叫、並行呼叫,以及在後續輪次回傳工具結果。
- GLM 模型會忽略強制指定工具(指定工具名稱、
required或any),可能直接用文字回答。DeepSeek 模型會依指定呼叫。
400 The value of the enable_thinking parameter is restricted to True.緩存與計費
前綴緩存自動生效,不需設定。緩存命中顯示在 usage.prompt_tokens_details.cached_tokens(Chat Completions)、usage.input_tokens_details.cached_tokens(Responses)和 usage.cache_read_input_tokens(Anthropic Messages)。
Anthropic 請求裡的 cache_control 斷點會在送出前移除,所以不支援顯式緩存,自動緩存照常生效。2026-10-02 實測,Claude Code 從第二輪起有 94%–99% 的 prompt 命中緩存。
價格以美國區官方價為基準,與其他 DeepSeek、GLM 頁面不同。你的密鑰適用的價格見登入後的模型廣場。
- 三個 DeepSeek 模型依北京時間(UTC+8)每天分尖離峰計價:每天 08:00–22:00 為尖峰,含週末。
- 離峰時段輸入、緩存輸入、輸出單價全部減半。
- 一次請求按完成時刻計價,只有一個單價。
- GLM 模型不分尖離峰。
用 Anthropic Messages 對賬時,input_tokens 不含緩存命中部分,對應用量記錄的「輸入 Token」;cache_read_input_tokens 對應「緩存輸入 Token」。
限制與報錯
| 情況 | 結果 |
|---|---|
GLM max_tokens 超過 131,072 | 400 |
DeepSeek max_tokens 超過 393,216 | 不拒絕 |
DeepSeek n 大於 1,或傳 logprobs | 400 |
GLM temperature 大於等於 2.0 | 400 |
| 容量暫時耗盡 | 429 |
400 Range of max_tokens should be [1, 131072]
400 Invalid n value (currently only n = 1 is supported)
400 Temperature should be in [0.0, 2.0)
429 Upstream accounts are currently rate limited, please retry later在 Anthropic Messages 上,GLM 的 max_tokens 報錯原文是 Range of max_completion_tokens should be [1, 131072]。429 不計費。請用指數退避重試:突發流量之後,模型可能在一分鐘內無法使用。
下一步
- Claude Code 與 Codex CLI:客戶端完整設定
- Anthropic SDK 與 OpenAI SDK:各協議的請求寫法
- 錯誤碼與重試
- 並行、逾時與計費