建立回應
OpenAI Responses API:Codex CLI 與 GPT、GLM、千問、Grok 等模型使用;無狀態,每輪需傳送完整歷史。
/v1/responsesOpenAI Responses 相容端點,Codex CLI 走這裡。HopBase 的 Responses 是無狀態的:store 固定為 false,previous_response_id 會被移除,多輪對話請每次傳送完整 input。
未列出的欄位原樣轉發;模型不收的欄位(如 DeepSeek 的 truncation、reasoning.summary)由各模型頁說明是否靜默刪除。串流輸出中途失敗時以 event: response.failed 下發,HTTP 狀態仍為 200。
請求標頭
Bearer sk-…:主控台「API 金鑰」中建立的金鑰,所屬分組須包含請求的模型
請求主體參數JSON
目前金鑰分組內的模型 ID。支援 Responses 的分組:GPT(Codex)、GLM-5.3、千問、Grok,以及 deepseek-v4.1-flash;Gemini 不支援
字串會自動包成單條使用者訊息;也可傳訊息陣列。千問的內容分片只收 input_text、input_image、input_file,不收影片
user / assistant / system / developer
字串或內容分片陣列
輸出上限。網關不截斷、不改寫;上限按模型官方規格
true 回傳 Responses SSE 事件流,見串流事件
預設false
工具定義,原樣轉發。Responses 的函式工具是扁平結構(name 與 type 同級),不同於 Chat Completions
function,或模型支援的伺服器端工具型別
函式名
函式用途
參數的 JSON Schema
原樣轉發
推理配置,原樣轉發。Codex CLI 的 model_reasoning_effort 即寫入這裡
GPT:low / medium / high / xhigh,檔位越高思考越久、token 消耗越多。grok-4.20-multi-agent-0309 用它控制協作的代理數量
只保留 priority / flex;其他取值會被移除後再轉發
可選值priorityflex
不支援:網關會移除此欄位,不會接續上一輪。多輪對話請在 input 裡帶上完整歷史
固定為 false:伺服器端不儲存回應,不能事後按 ID 取回
預設false
回傳
200成功。非串流為 response JSON;stream: true 時為 SSE
回應 ID(store 固定為 false,不能按 ID 取回)
Unix 秒
completed / incomplete / failed
模型 ID
輸出項:message、reasoning、function_call 等
message / reasoning / function_call
message 為 assistant
message 的內容分片
output_text
輸出文字
function_call:函式名
function_call:JSON 字串參數
function_call:回傳結果時引用
Token 用量
輸入 Token
輸出 Token,含推理 Token
合計
其中推理 Token
失敗時的錯誤
錯誤
missing_api_key / invalid_api_key / api_key_expired)insufficient_quota)model_not_found),或路徑不屬於該分組(route_not_found)request_too_large)user_concurrency_limit / apikey_concurrency_limit),帶 Retry-Afterprevious_response_id 開新對話