レスポンスを作成
OpenAI Responses API:Codex CLI と GPT、GLM、Qwen、Grok などのモデルが使います。ステートレスのため、毎ターン履歴全体を送る必要があります。
/v1/responsesOpenAI Responses 互換のエンドポイントで、Codex CLI はこちらを使います。HopBase の Responses はステートレスです。store は false 固定、previous_response_id は削除されるため、マルチターンの会話では毎回 input 全体を送ってください。
記載のないフィールドはそのまま転送されます。モデルが受け付けないフィールド(DeepSeek の truncation、reasoning.summary など)を黙って削除するかどうかは各モデルページに記載しています。ストリーミング出力の途中で失敗した場合は event: response.failed で通知され、HTTP ステータスは 200 のままです。
ヘッダー
Bearer sk-…:コンソールの「API キー」で作成したキー。キーのグループにリクエストするモデルが含まれている必要があります
リクエストボディJSON
現在のキーのグループに含まれるモデル ID。Responses に対応するグループ:GPT(Codex)、GLM-5.3、Qwen、Grok、および deepseek-v4.1-flash。Gemini は非対応です
文字列は自動的に 1 件のユーザーメッセージに包まれます。メッセージ配列も指定できます。Qwen のコンテンツパーツは input_text、input_image、input_file のみ受け付け、動画は受け付けません
user / assistant / system / developer
文字列またはコンテンツパーツの配列
出力上限。ゲートウェイは切り詰めも書き換えもしません。上限はモデルの公式仕様に従います
true で Responses の SSE イベントストリームを返します。ストリーミングイベントを参照
デフォルトfalse
ツール定義。そのまま転送されます。Responses の関数ツールはフラットな構造(name と type が同じ階層)で、Chat Completions とは異なります
function、またはモデルが対応するサーバー側ツールの種類
関数名
関数の用途
パラメータの JSON Schema
そのまま転送
推論設定。そのまま転送されます。Codex CLI の model_reasoning_effort はここに書き込まれます
GPT:low / medium / high / xhigh。レベルが高いほど長く思考し、トークン消費も増えます。grok-4.20-multi-agent-0309 では協調するエージェント数の制御に使います
priority / flex のみ保持します。その他の値は削除してから転送します
取りうる値priorityflex
非対応:ゲートウェイはこのフィールドを削除し、前のターンを引き継ぎません。マルチターンの会話では input に履歴全体を含めてください
false 固定:サーバー側でレスポンスを保存しないため、後から ID で取得できません
デフォルトfalse
レスポンス
200成功。非ストリーミングでは response JSON、stream: true のときは SSE
レスポンス ID(store は false 固定のため、ID で取得はできません)
Unix 秒
completed / incomplete / failed
モデル ID
出力項目:message、reasoning、function_call など
message / reasoning / function_call
message では assistant
message のコンテンツパーツ
output_text
出力テキスト
function_call:関数名
function_call:JSON 文字列の引数
function_call:結果を返すときに参照します
トークン使用量
入力トークン
出力トークン(推論トークンを含む)
合計
うち推論トークン
失敗時のエラー
エラー
missing_api_key / invalid_api_key / api_key_expired)insufficient_quota)model_not_found)、またはパスがそのグループに属さない(route_not_found)request_too_large)user_concurrency_limit / apikey_concurrency_limit)。Retry-After 付きprevious_response_id を外して新しい会話を始めてください