跳到正文

美國區:DeepSeek 與 GLM

用 OpenAI Chat Completions、OpenAI Responses 或 Anthropic Messages 呼叫美國區的 DeepSeek 與 GLM 模型。

項目值
Base URLhttps://api.hop-base.com/v1
OpenAI Chat CompletionsPOST /v1/chat/completions
OpenAI ResponsesPOST /v1/responses
Anthropic MessagesPOST /v1/messages

美國區模型是一組獨立的模型 ID,全部以 -us 結尾。每個模型都支援這三種協議,同一把密鑰、同一個模型 ID 通用,依你的客戶端選協議即可。

curl https://api.hop-base.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4.1-flash-us",
    "messages": [{ "role": "user", "content": "用五條重點總結本季的風險。" }]
  }'

模型

模型 ID上下文窗口最大輸出 tokens圖片輸入
deepseek-v4.1-flash-us1M393,216支援
deepseek-v4-pro-us1M393,216不支援
deepseek-v4-flash-us1M393,216不支援
glm-5.3-us1M131,072不支援
glm-5.2-us1M131,072不支援

DeepSeek 模型在「DeepSeek 美國區」分組,GLM 模型在「GLM 美國區」分組。在控制台「API 金鑰」把分組加進密鑰;不含該分組的密鑰呼叫會回傳 404。建立密鑰的視窗裡,這兩個分組都列在「美國區」分類下。

deepseek-v4-pro-us 是 2026-08-13 發布版,deepseek-v4-flash-us 是 2026-07-31 發布版。不支援圖片輸入的模型看不到圖片:請求照常成功,模型會回答沒有收到圖片。

這些 ID 與 DeepSeek、GLM-5.3 頁面上的模型彼此獨立,限制、價格和協議支援都不同。呼叫 -us 模型以本頁為準。

選擇協議

客戶端協議端點
OpenAI SDK、Cherry Studio、Cursor、DifyOpenAI Chat Completions/v1/chat/completions
Codex CLIOpenAI Responses/v1/responses
Claude Code、Anthropic SDKAnthropic Messages/v1/messages

鑑權用 Authorization: Bearer sk-your-key;在 /v1/messages 上也可以用 x-api-key 請求標頭。所有回應裡的 model 欄位都回顯你請求的 ID。

Claude Code

把 Claude Code 指向 HopBase,再選一個 -us 模型。Claude Code 不認得這些 ID,所以還要告訴它真實的上下文窗口,否則它會在 200K tokens 時壓縮對話。

export ANTHROPIC_BASE_URL="https://api.hop-base.com"
export ANTHROPIC_AUTH_TOKEN="sk-your-key"
export ANTHROPIC_MODEL="deepseek-v4.1-flash-us"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek-v4-flash-us"
export CLAUDE_CODE_MAX_CONTEXT_TOKENS=1000000
claude

ANTHROPIC_DEFAULT_HAIKU_MODEL 是 Claude Code 產生標題等背景工作時使用的模型。一鍵設定與 settings.json 寫法見 Claude Code。

Codex CLI

在 ~/.codex/config.toml 加一個 provider,wire_api 設為 responses。

model = "deepseek-v4.1-flash-us"
model_provider = "hopbase"

[model_providers.hopbase]
name = "HopBase"
base_url = "https://api.hop-base.com/v1"
env_key = "HOPBASE_API_KEY"
wire_api = "responses"

接著設定環境變數 HOPBASE_API_KEY 並執行 codex。更多選項見 Codex CLI。

思考與工具調用

五個模型預設都會思考。Chat Completions 在 reasoning_content 回傳思考過程,Anthropic Messages 用 thinking 區塊,Responses 用推理項。輸出 tokens 已經包含思考部分。

  • glm-5.3-us 始終思考,關閉思考會回傳 400。
  • 在 Anthropic Messages 上,GLM 模型的 output_config.effort 會對應到 low、high 或 max:medium 視為 high,xhigh 視為 max。DeepSeek 原樣接收。
  • 函式呼叫完整可用:單次呼叫、並行呼叫,以及在後續輪次回傳工具結果。
  • GLM 模型會忽略強制指定工具(指定工具名稱、required 或 any),可能直接用文字回答。DeepSeek 模型會依指定呼叫。
400 The value of the enable_thinking parameter is restricted to True.

緩存與計費

前綴緩存自動生效,不需設定。緩存命中顯示在 usage.prompt_tokens_details.cached_tokens(Chat Completions)、usage.input_tokens_details.cached_tokens(Responses)和 usage.cache_read_input_tokens(Anthropic Messages)。

Anthropic 請求裡的 cache_control 斷點會在送出前移除,所以不支援顯式緩存,自動緩存照常生效。2026-10-02 實測,Claude Code 從第二輪起有 94%–99% 的 prompt 命中緩存。

價格以美國區官方價為基準,與其他 DeepSeek、GLM 頁面不同。你的密鑰適用的價格見登入後的模型廣場。

  • 三個 DeepSeek 模型依北京時間(UTC+8)每天分尖離峰計價:每天 08:00–22:00 為尖峰,含週末。
  • 離峰時段輸入、緩存輸入、輸出單價全部減半。
  • 一次請求按完成時刻計價,只有一個單價。
  • GLM 模型不分尖離峰。

用 Anthropic Messages 對賬時,input_tokens 不含緩存命中部分,對應用量記錄的「輸入 Token」;cache_read_input_tokens 對應「緩存輸入 Token」。

限制與報錯

情況結果
GLM max_tokens 超過 131,072400
DeepSeek max_tokens 超過 393,216不拒絕
DeepSeek n 大於 1,或傳 logprobs400
GLM temperature 大於等於 2.0400
容量暫時耗盡429
400 Range of max_tokens should be [1, 131072]
400 Invalid n value (currently only n = 1 is supported)
400 Temperature should be in [0.0, 2.0)
429 Upstream accounts are currently rate limited, please retry later

在 Anthropic Messages 上,GLM 的 max_tokens 報錯原文是 Range of max_completion_tokens should be [1, 131072]。429 不計費。請用指數退避重試:突發流量之後,模型可能在一分鐘內無法使用。

下一步