画像を生成
OpenAI Images 互換のテキストからの画像生成:GPT Image、Gemini Banana、Seedream。Seedream と Gemini はここで参照画像も渡せます。
/v1/images/generationsプロンプトから画像を生成します。GPT Image と Gemini は data[].b64_json を、Seedream は data[].url(24 時間有効)を返します。Seedream と 2 つの Gemini グループは、このエンドポイントで image / images を使った画像から画像への生成にも対応します。
モデルごとにパラメータと上限が異なります:下でモデルを選ぶとパラメータ表が切り替わります。数値はプラグインの検証コードからエクスポートした仕様(/spec/models/<model>.json と同じソース)です。GPT Image の生成が約 40 秒を超えると、サーバーは先に 200 を返して空白のキープアライブを書き込み、その後に失敗しても 200 のままです。成否はレスポンスボディに error が含まれるかで判断し、クライアントの読み取りタイムアウトは 300 秒以上にしてください。
Kling と Midjourney もこのエンドポイントで送信しますが、すべて非同期(202 + id、動画タスクを照会でポーリング)です。モデル選択で「Kling」「Midjourney」を選ぶと確認できます。Grok Imagine は Grok Imagine 画像生成 を参照してください。
- GPT Image は公式のストリーミングフィールド
partial_imagesに対応していないため、省略してください。stream: trueで返るのは HopBase Images SSE で、1 枚ずつのプレビューイベントではありません。 output_compression、moderation、user、response_formatは同期のテキストから画像 JSON と同期の multipart 編集でのみそのまま渡されます。JSON 編集と非同期タスクではこれらのフィールドは保持されません。GPT Image の非同期で保持されるのはmodel、prompt、n、size、quality、background、output_format、input_fidelityと、編集用の画像 / mask のみです。- Gemini の課金:「Gemini 全モデル(画像生成含む)」は 1 枚あたりの固定価格(1K / 2K / 4K 同額)、「Gemini 公式ダイレクト」は token 課金(出力 token × 単価)です。
- Chat Completions から Images へのブリッジ経路では参照画像は先頭 6 枚までしか保持されません。14 枚使う場合はこのエンドポイントを直接呼び出してください。
ヘッダー
Bearer sk-…:コンソールの「API キー」で作成したキー。キーのグループにリクエストするモデルが含まれている必要があります
respond-async:GPT Image / Gemini は即座に 202 Accepted、task_id、status_url を返すので、GET /v1/images/tasks?task_id=… でポーリングします。2K / 4K の大きな画像を生成する場合に推奨します。Seedream はこのヘッダーを無視し、通常どおり同期で返します
取りうる値respond-async
リクエストボディJSON
data[].b64_json から読み取ります。 参照画像は最大 16 枚。まず現在のキーの GET /v1/models にこの ID が含まれていることを確認してください
生成または編集の指示。空の場合は 400 prompt must not be empty。ゲートウェイでは長さを制限せず、上限は公式上限に従います
制限前後の空白を除いて空にはできません。空の場合は 400「prompt must not be empty」長さ1–32000 文字
例:1024x1024、2048x2048、3840x2160。不正な値は生成前に 400 を返し、課金されません。1K / 2K / 4K は受け付けません
制限auto または 幅x高さ:辺の長さは 16 の倍数、1 辺 3840 以下、長辺と短辺の比 3:1 以下、総ピクセル数 655360–8294400
レベルが高いほど出力トークンが増え、費用も高くなります。1024x1024 の実測では low 約 200、high 約 1,760、xhigh 約 3,120、max 約 7,020 出力トークンです
取りうる値autolowmediumhigh
制限ゲートウェイでは検証せず、そのまま転送。レベルが高いほど出力トークンが増えます
一部のグループは 1 のみ対応で、それより大きい値は 400 を返します。0 以下は 1 として扱います
範囲1–10デフォルト1
transparent は png または webp と組み合わせる必要があります。2.0 の透明背景はプレビュー機能です
取りうる値autoopaquetransparent
b64_json をデコードした後の形式を決めます
取りうる値pngjpegwebp
jpeg / webp のみ。同期の generations JSON と multipart の編集でのみ保持されます
範囲0–100デフォルト100
コンテンツの安全性チェックを無効にするものではありません
取りうる値autolow
エンドユーザー識別用の文字列。HopBase のアカウント ID ではなく、課金の帰属も変わりません
何を指定しても b64_json で返され、url でダウンロードリンクは取得できません。省略してください
true にすると HopBase Images SSE になります(その間キープアライブを送信し、最後の data: イベントだけが Images JSON で、[DONE] で終わります)。OpenAI ネイティブの画像ごとのプレビューイベントではありません。SDK では false のままにしてください
制限true で HopBase Images SSE を返します。SDK では false のままにしてくださいデフォルトfalse
互換用フィールド。GPT Image 2 は既定で参照画像を高忠実度で処理するため、省略してください
取りうる値lowhigh
- transparent には png または webp が必要です
- output_compression は jpeg / webp でのみ有効です
まず現在のキーの GET /v1/models にこの ID が含まれていることを確認してください
生成または編集の指示。空の場合は 400 prompt must not be empty。ゲートウェイでは長さを制限せず、上限は公式上限に従います
制限前後の空白を除いて空にはできません。空の場合は 400「prompt must not be empty」長さ1–32000 文字
例:1024x1024、2048x2048、3840x2160。不正な値は生成前に 400 を返し、課金されません。1K / 2K / 4K は受け付けません
制限auto または 幅x高さ:辺の長さは 16 の倍数、1 辺 3840 以下、長辺と短辺の比 3:1 以下、総ピクセル数 655360–8294400
レベルが高いほど出力トークンが増え、費用も高くなります。1024x1024 の実測では low 約 200、high 約 1,760、xhigh 約 3,120、max 約 7,020 出力トークンです
取りうる値autolowmediumhighxhighmax
制限ゲートウェイでは検証せず、そのまま転送。レベルが高いほど出力トークンが増えます
一部のグループは 1 のみ対応で、それより大きい値は 400 を返します。0 以下は 1 として扱います
範囲1–10デフォルト1
transparent は png または webp と組み合わせる必要があります。2.0 の透明背景はプレビュー機能です
取りうる値autoopaquetransparent
b64_json をデコードした後の形式を決めます
取りうる値pngjpegwebp
jpeg / webp のみ。同期の generations JSON と multipart の編集でのみ保持されます
範囲0–100デフォルト100
コンテンツの安全性チェックを無効にするものではありません
取りうる値autolow
エンドユーザー識別用の文字列。HopBase のアカウント ID ではなく、課金の帰属も変わりません
何を指定しても b64_json で返され、url でダウンロードリンクは取得できません。省略してください
true にすると HopBase Images SSE になります(その間キープアライブを送信し、最後の data: イベントだけが Images JSON で、[DONE] で終わります)。OpenAI ネイティブの画像ごとのプレビューイベントではありません。SDK では false のままにしてください
制限true で HopBase Images SSE を返します。SDK では false のままにしてくださいデフォルトfalse
互換用フィールド。GPT Image 2 は既定で参照画像を高忠実度で処理するため、省略してください
取りうる値lowhigh
- transparent には png または webp が必要です
- output_compression は jpeg / webp でのみ有効です
まず現在のキーの GET /v1/models にこの ID が含まれていることを確認してください
生成または編集の指示。空の場合は 400 prompt must not be empty。ゲートウェイでは長さを制限せず、上限は公式上限に従います
制限前後の空白を除いて空にはできません。空の場合は 400「prompt must not be empty」長さ1–32000 文字
例:1024x1024、2048x2048、3840x2160。不正な値は生成前に 400 を返し、課金されません。1K / 2K / 4K は受け付けません
制限auto または 幅x高さ:辺の長さは 16 の倍数、1 辺 3840 以下、長辺と短辺の比 3:1 以下、総ピクセル数 655360–8294400
レベルが高いほど出力トークンが増え、費用も高くなります。1024x1024 の実測では low 約 200、high 約 1,760、xhigh 約 3,120、max 約 7,020 出力トークンです
取りうる値autolowmediumhighxhighmax
制限ゲートウェイでは検証せず、そのまま転送。レベルが高いほど出力トークンが増えます
一部のグループは 1 のみ対応で、それより大きい値は 400 を返します。0 以下は 1 として扱います
範囲1–10デフォルト1
transparent は png または webp と組み合わせる必要があります。2.0 の透明背景はプレビュー機能です
取りうる値autoopaquetransparent
b64_json をデコードした後の形式を決めます
取りうる値pngjpegwebp
jpeg / webp のみ。同期の generations JSON と multipart の編集でのみ保持されます
範囲0–100デフォルト100
コンテンツの安全性チェックを無効にするものではありません
取りうる値autolow
エンドユーザー識別用の文字列。HopBase のアカウント ID ではなく、課金の帰属も変わりません
何を指定しても b64_json で返され、url でダウンロードリンクは取得できません。省略してください
true にすると HopBase Images SSE になります(その間キープアライブを送信し、最後の data: イベントだけが Images JSON で、[DONE] で終わります)。OpenAI ネイティブの画像ごとのプレビューイベントではありません。SDK では false のままにしてください
制限true で HopBase Images SSE を返します。SDK では false のままにしてくださいデフォルトfalse
互換用フィールド。GPT Image 2 は既定で参照画像を高忠実度で処理するため、省略してください
取りうる値lowhigh
- transparent には png または webp が必要です
- output_compression は jpeg / webp でのみ有効です
現在のキーの GET /v1/models の返り値が基準です
モデルが拒否した、またはテキストのみを返した場合は 400(メッセージにそのテキストを引用)または 502 を返します。プロンプトを書き換えてください
制限前後の空白を除いて空にはできません。空の場合は 400「prompt must not be empty」長さ≥ 1 文字
並列で生成します。全か無か:いずれか 1 枚でも失敗するとリクエスト全体が失敗し、課金されません
制限出力解像度ごとの上限:1K ≤ 10、2K ≤ 5範囲1–10デフォルト1
トップレベルのフラットな書き方で、google.image_config.image_size と等価です。size から導かれるレベルを上書きします
取りうる値1K2K
デフォルト"1K"
トップレベルのフラットな書き方で、google.image_config.aspect_ratio と等価です。size より優先されます
取りうる値1:12:33:23:44:34:55:49:1616:921:9
デフォルト"1:1"
幅x高さ は比率を理由に拒否されることはありません。最も近い公式の比率に対応付けられ、レベルは長辺から導かれ、モデルの最高レベルまで黙って引き下げられます。モデルのレベルを超える 1K / 2K / 4K を明示すると 400 を返します。image_size も同時に指定した場合はそちらが優先されます
取りうる値1K2K
制限auto、任意の比率の 幅x高さ(最も近い公式の比率に対応付け、解像度は長辺から導き、モデルの最高解像度まで黙って引き下げ)、またはモデルの解像度
SDK では extra_body.google.image_config とも書けます。3 つの書き方は等価です
取りうる値1:12:33:23:44:34:55:49:1616:921:9
取りうる値1K2K
参照画像。generations のリクエストボディに入れるだけで使えます。両方指定した場合は images が優先されます。「Gemini 公式ダイレクト」は 1 枚あたりデコード後 20 MiB 以下で、/v1/images/edits はありません
制限参照画像:文字列または文字列の配列、最大 14 枚
image と同じ。両方指定した場合は images が優先されます
制限参照画像:文字列または文字列の配列、最大 14 枚
非対応:mask を指定すると 400 を返します。部分的な修正はプロンプトで領域を説明してください
transparent には非対応(400 を返します)
指定不可"transparent"
非対応。省略するか false を指定してください
指定不可true
- 2K 出力は 1 回あたり最大 5 枚(レスポンスサイズの上限)
現在のキーの GET /v1/models の返り値が基準です
モデルが拒否した、またはテキストのみを返した場合は 400(メッセージにそのテキストを引用)または 502 を返します。プロンプトを書き換えてください
制限前後の空白を除いて空にはできません。空の場合は 400「prompt must not be empty」長さ≥ 1 文字
並列で生成します。全か無か:いずれか 1 枚でも失敗するとリクエスト全体が失敗し、課金されません
制限出力解像度ごとの上限:1K ≤ 10、2K ≤ 5範囲1–10デフォルト1
トップレベルのフラットな書き方で、google.image_config.image_size と等価です。size から導かれるレベルを上書きします
取りうる値1K2K
デフォルト"1K"
トップレベルのフラットな書き方で、google.image_config.aspect_ratio と等価です。size より優先されます
取りうる値1:12:33:23:44:34:55:49:1616:921:9
デフォルト"1:1"
幅x高さ は比率を理由に拒否されることはありません。最も近い公式の比率に対応付けられ、レベルは長辺から導かれ、モデルの最高レベルまで黙って引き下げられます。モデルのレベルを超える 1K / 2K / 4K を明示すると 400 を返します。image_size も同時に指定した場合はそちらが優先されます
取りうる値1K2K
制限auto、任意の比率の 幅x高さ(最も近い公式の比率に対応付け、解像度は長辺から導き、モデルの最高解像度まで黙って引き下げ)、またはモデルの解像度
SDK では extra_body.google.image_config とも書けます。3 つの書き方は等価です
取りうる値1:12:33:23:44:34:55:49:1616:921:9
取りうる値1K2K
参照画像。generations のリクエストボディに入れるだけで使えます。両方指定した場合は images が優先されます。「Gemini 公式ダイレクト」は 1 枚あたりデコード後 20 MiB 以下で、/v1/images/edits はありません
制限参照画像:文字列または文字列の配列、最大 14 枚
image と同じ。両方指定した場合は images が優先されます
制限参照画像:文字列または文字列の配列、最大 14 枚
非対応:mask を指定すると 400 を返します。部分的な修正はプロンプトで領域を説明してください
transparent には非対応(400 を返します)
指定不可"transparent"
非対応。省略するか false を指定してください
指定不可true
- 2K 出力は 1 回あたり最大 5 枚(レスポンスサイズの上限)
現在のキーの GET /v1/models の返り値が基準です
モデルが拒否した、またはテキストのみを返した場合は 400(メッセージにそのテキストを引用)または 502 を返します。プロンプトを書き換えてください
制限前後の空白を除いて空にはできません。空の場合は 400「prompt must not be empty」長さ≥ 1 文字
並列で生成します。全か無か:いずれか 1 枚でも失敗するとリクエスト全体が失敗し、課金されません
制限出力解像度ごとの上限:1K ≤ 10、2K ≤ 5、4K ≤ 2範囲1–10デフォルト1
トップレベルのフラットな書き方で、google.image_config.image_size と等価です。size から導かれるレベルを上書きします
取りうる値1K2K4K
デフォルト"1K"
トップレベルのフラットな書き方で、google.image_config.aspect_ratio と等価です。size より優先されます
取りうる値1:12:33:23:44:34:55:49:1616:921:9
デフォルト"1:1"
幅x高さ は比率を理由に拒否されることはありません。最も近い公式の比率に対応付けられ、レベルは長辺から導かれ、モデルの最高レベルまで黙って引き下げられます。モデルのレベルを超える 1K / 2K / 4K を明示すると 400 を返します。image_size も同時に指定した場合はそちらが優先されます
取りうる値1K2K4K
制限auto、任意の比率の 幅x高さ(最も近い公式の比率に対応付け、解像度は長辺から導き、モデルの最高解像度まで黙って引き下げ)、またはモデルの解像度
SDK では extra_body.google.image_config とも書けます。3 つの書き方は等価です
取りうる値1:12:33:23:44:34:55:49:1616:921:9
取りうる値1K2K4K
参照画像。generations のリクエストボディに入れるだけで使えます。両方指定した場合は images が優先されます。「Gemini 公式ダイレクト」は 1 枚あたりデコード後 20 MiB 以下で、/v1/images/edits はありません
制限参照画像:文字列または文字列の配列、最大 14 枚
image と同じ。両方指定した場合は images が優先されます
制限参照画像:文字列または文字列の配列、最大 14 枚
非対応:mask を指定すると 400 を返します。部分的な修正はプロンプトで領域を説明してください
transparent には非対応(400 を返します)
指定不可"transparent"
非対応。省略するか false を指定してください
指定不可true
- 2K 出力は 1 回あたり最大 5 枚(レスポンスサイズの上限)
- 4K 出力は 1 回あたり最大 2 枚(レスポンスサイズの上限)
現在のキーの GET /v1/models の返り値が基準です
モデルが拒否した、またはテキストのみを返した場合は 400(メッセージにそのテキストを引用)または 502 を返します。プロンプトを書き換えてください
制限前後の空白を除いて空にはできません。空の場合は 400「prompt must not be empty」長さ≥ 1 文字
並列で生成します。全か無か:いずれか 1 枚でも失敗するとリクエスト全体が失敗し、課金されません
制限出力解像度ごとの上限:1K ≤ 10範囲1–10デフォルト1
トップレベルのフラットな書き方で、google.image_config.image_size と等価です。size から導かれるレベルを上書きします
取りうる値1K
デフォルト"1K"
トップレベルのフラットな書き方で、google.image_config.aspect_ratio と等価です。size より優先されます
取りうる値1:12:33:23:44:34:55:49:1616:921:9
デフォルト"1:1"
幅x高さ は比率を理由に拒否されることはありません。最も近い公式の比率に対応付けられ、レベルは長辺から導かれ、モデルの最高レベルまで黙って引き下げられます。モデルのレベルを超える 1K / 2K / 4K を明示すると 400 を返します。image_size も同時に指定した場合はそちらが優先されます
取りうる値1K
制限auto、任意の比率の 幅x高さ(最も近い公式の比率に対応付け、解像度は長辺から導き、モデルの最高解像度まで黙って引き下げ)、またはモデルの解像度
SDK では extra_body.google.image_config とも書けます。3 つの書き方は等価です
取りうる値1:12:33:23:44:34:55:49:1616:921:9
取りうる値1K
参照画像。generations のリクエストボディに入れるだけで使えます。両方指定した場合は images が優先されます。「Gemini 公式ダイレクト」は 1 枚あたりデコード後 20 MiB 以下で、/v1/images/edits はありません
制限参照画像:文字列または文字列の配列、最大 14 枚
image と同じ。両方指定した場合は images が優先されます
制限参照画像:文字列または文字列の配列、最大 14 枚
非対応:mask を指定すると 400 を返します。部分的な修正はプロンプトで領域を説明してください
transparent には非対応(400 を返します)
指定不可"transparent"
非対応。省略するか false を指定してください
指定不可true
現在のキーの GET /v1/models の返り値が基準です
モデルが拒否した、またはテキストのみを返した場合は 400(メッセージにそのテキストを引用)または 502 を返します。プロンプトを書き換えてください
制限前後の空白を除いて空にはできません。空の場合は 400「prompt must not be empty」長さ≥ 1 文字
並列で生成します。全か無か:いずれか 1 枚でも失敗するとリクエスト全体が失敗し、課金されません
制限出力解像度ごとの上限:1K ≤ 10範囲1–10デフォルト1
トップレベルのフラットな書き方で、google.image_config.image_size と等価です。size から導かれるレベルを上書きします
取りうる値1K
デフォルト"1K"
トップレベルのフラットな書き方で、google.image_config.aspect_ratio と等価です。size より優先されます
取りうる値1:12:33:23:44:34:55:49:1616:921:9
デフォルト"1:1"
幅x高さ は比率を理由に拒否されることはありません。最も近い公式の比率に対応付けられ、レベルは長辺から導かれ、モデルの最高レベルまで黙って引き下げられます。モデルのレベルを超える 1K / 2K / 4K を明示すると 400 を返します。image_size も同時に指定した場合はそちらが優先されます
取りうる値1K
制限auto、任意の比率の 幅x高さ(最も近い公式の比率に対応付け、解像度は長辺から導き、モデルの最高解像度まで黙って引き下げ)、またはモデルの解像度
SDK では extra_body.google.image_config とも書けます。3 つの書き方は等価です
取りうる値1:12:33:23:44:34:55:49:1616:921:9
取りうる値1K
参照画像。generations のリクエストボディに入れるだけで使えます。両方指定した場合は images が優先されます。「Gemini 公式ダイレクト」は 1 枚あたりデコード後 20 MiB 以下で、/v1/images/edits はありません
制限参照画像:文字列または文字列の配列、最大 3 枚
image と同じ。両方指定した場合は images が優先されます
制限参照画像:文字列または文字列の配列、最大 3 枚
非対応:mask を指定すると 400 を返します。部分的な修正はプロンプトで領域を説明してください
transparent には非対応(400 を返します)
指定不可"transparent"
非対応。省略するか false を指定してください
指定不可true
現在のキーの GET /v1/models が返す完全な ID を使ってください
画像の内容、構図、スタイル、または編集指示。部分編集では座標、bbox、矢印、参照画像内の塗りつぶし領域を説明できます
制限前後の空白を除いて空にはできません。空の場合は 400「missing prompt」長さ≥ 1 文字
不正な値は生成前に 400 を返して有効な範囲を示し、課金されません
取りうる値1K1.5K2K
制限略記 1K / 1.5K / 2K、または 幅x高さ:総ピクセル数 921600–4624220、アスペクト比 1:16–16:1
その他の値(null を含む)は 400 を返します
制限only a single output is supported (n=1)デフォルト1
24 時間有効な署名付き直リンクを返します
取りうる値url
デフォルト"url"
4.5 は jpeg のみ
取りうる値pngjpeg
オブジェクトである必要があります
取りうる値standardfast
指定すると単一 / 複数画像からの画像生成または編集になります。/v1/images/edits では 1 枚以上が必須です。URL は送信時にダウンロードされず、サイズもチェックされません
制限参照画像(指定すると画像から画像 / 編集):最大 10 枚。Data URL は 1 枚 31457280 バイト以下。URL は送信時にダウンロードされません
サーバー側で false 固定
制限サーバー側で false 固定。指定しても効果はありません
現在のキーの GET /v1/models が返す完全な ID を使ってください
画像の内容、構図、スタイル、または編集指示。部分編集では座標、bbox、矢印、参照画像内の塗りつぶし領域を説明できます
制限前後の空白を除いて空にはできません。空の場合は 400「missing prompt」長さ≥ 1 文字
不正な値は生成前に 400 を返して有効な範囲を示し、課金されません
取りうる値2K3K4K
制限略記 2K / 3K / 4K、または 幅x高さ:総ピクセル数 3686400–16777216、アスペクト比 1:16–16:1
その他の値(null を含む)は 400 を返します
制限only a single output is supported (n=1)デフォルト1
24 時間有効な署名付き直リンクを返します
取りうる値url
デフォルト"url"
4.5 は jpeg のみ
取りうる値pngjpeg
オブジェクトである必要があります
取りうる値standard
指定すると単一 / 複数画像からの画像生成または編集になります。/v1/images/edits では 1 枚以上が必須です。URL は送信時にダウンロードされず、サイズもチェックされません
制限参照画像(指定すると画像から画像 / 編集):最大 14 枚。Data URL は 1 枚 31457280 バイト以下。URL は送信時にダウンロードされません
サーバー側で false 固定
制限サーバー側で false 固定。指定しても効果はありません
現在のキーの GET /v1/models が返す完全な ID を使ってください
画像の内容、構図、スタイル、または編集指示。部分編集では座標、bbox、矢印、参照画像内の塗りつぶし領域を説明できます
制限前後の空白を除いて空にはできません。空の場合は 400「missing prompt」長さ≥ 1 文字
不正な値は生成前に 400 を返して有効な範囲を示し、課金されません
取りうる値2K4K
制限略記 2K / 4K、または 幅x高さ:総ピクセル数 3686400–16777216、アスペクト比 1:16–16:1
その他の値(null を含む)は 400 を返します
制限only a single output is supported (n=1)デフォルト1
24 時間有効な署名付き直リンクを返します
取りうる値url
デフォルト"url"
4.5 は jpeg のみ
取りうる値jpeg
オブジェクトである必要があります
取りうる値standard
指定すると単一 / 複数画像からの画像生成または編集になります。/v1/images/edits では 1 枚以上が必須です。URL は送信時にダウンロードされず、サイズもチェックされません
制限参照画像(指定すると画像から画像 / 編集):最大 14 枚。Data URL は 1 枚 31457280 バイト以下。URL は送信時にダウンロードされません
サーバー側で false 固定
制限サーバー側で false 固定。指定しても効果はありません
Kling の画像生成モデル ID。動画モデルを渡すと 400 を返します
取りうる値kling-image-expandkling-image-o1kling-image-v2-1kling-image-v2-1-i2ikling-image-v2-1-multi-refkling-image-v3kling-image-v3-omni
空でない images と少なくともどちらか一方を指定
大文字小文字を区別しません。OpenAI 形式の high、standard などは拒否されます。モデルごとの選択肢:kling-image-v3 1k / 2k、kling-image-v3-omni 1k / 2k / 4k、kling-image-o1 1k / 2k / 4k、kling-image-v2-1 1k / 2k、kling-image-v2-1-i2i 1k / 2k、kling-image-v2-1-multi-ref 1k / 2k、kling-image-expand 1k
取りうる値1k2k4k
デフォルト"1k"
実際に生成された枚数で課金
範囲1–9デフォルト1
参照画像。各項目は url(公開された HTTP(S) アドレス)/ file_id のどちらか一方で、usage は付けられません。file_id は現在のキーで使える Kling の素材である必要があり、Seedance の素材 ID ではありません。枚数:kling-image-v3 0–1 枚、kling-image-v3-omni 0–10 枚、kling-image-o1 0–10 枚、kling-image-v2-1 は受け付けません、kling-image-v2-1-i2i はちょうど 1 枚、kling-image-v2-1-multi-ref 2–4 枚、kling-image-expand はちょうど 1 枚
公開された HTTP(S) アドレス
Kling の素材 ID。url とどちらか一方
画像拡張 kling-image-expand のみ:4 つの比率はいずれも 0–2 の数値で、省略時は 0、すべて 0 にはできません。拡張後の面積は元画像の 3 倍以内:(1+左+右) × (1+上+下) ≤ 3。その他のモデルで空でない extra を渡すと 400 を返します
拡張比率
範囲0–2
拡張比率
範囲0–2
拡張比率
範囲0–2
拡張比率
範囲0–2
完全一致
画面の説明。説明の後に -- パラメータ(--ar アスペクト比、--hd ネイティブ 2K、--s、--c、--weird、--iw、--sref + --sw、--no、--seed、--tile、--exp)を付けられます。画面の説明は必須で、-- パラメータだけにはできず、:: も含められません。--ar の比率は 14:1 以内、--hd 付きの場合は 4:1 以内です。--q、--niji、--repeat、--oref、--cref、--stealth、--stop、--draft、--profile は 400 を返します
長さ≥ 1 文字
参照画像、0–1 項目。各項目は url(公開された絶対 HTTP(S) アドレス)/ file_id のどちらか一方で、usage は付けられません
個数≤ 1 個
公開された絶対 HTTP(S) アドレス
素材 ID。url とどちらか一方
4 のみ:1 タスクにつき常に 4 枚を出力し、返された画像 1 枚ごとに課金します
デフォルト4
省略してください:空でない値は 400 を返します。2K が必要な場合は prompt に --hd を書いてください
省略してください:空でないオブジェクトは 400 を返します
レスポンス
200同期で成功
202非同期受理:GPT Image / Gemini は Prefer: respond-async を付けたとき。Kling と Midjourney は常にこの形
Unix 秒
画像 1 枚につき 1 項目
GPT Image / Gemini:Base64 の画像データ。デコード後は output_format に従って保存します。Gemini は JPEG の場合があるため mime_type を確認してください
Seedream:24 時間有効な署名付き直リンク。期限切れ後は再生成するしかありません
画像の MIME
モデルが書き換えたプロンプト(一部のモデル)
返される場合あり
入力トークン
出力トークン
合計
エラー
safety_rejectedmissing_api_key / invalid_api_key / api_key_expired)insufficient_quota)model_not_found)、またはパスがそのグループに属さない(route_not_found)request_too_large)user_concurrency_limit / apikey_concurrency_limit)。Retry-After 付きGPT Image のエラーメッセージ原文
# size: 上表のサイズ規則に従って修正
size must be WIDTHxHEIGHT or auto
size side length exceeds 3840px (4096x2048)
size width and height must be multiples of 16 (1000x1000)
size aspect ratio must not exceed 3:1 (3840x1024)
size total pixel count must be at least 655360 (512x512=262144)
size total pixel count must not exceed 8294400 (3840x3840=14745600)
# prompt が空
prompt must not be empty
# edits JSON: 参照画像は "image" に文字列または {"url": ...} で指定。"images" は読み取らない
/v1/images/edits requires at least one image
image object is missing the url field
image must be a data URL or an http(s) URL
# リモート参照画像:image/* を返す公開 URL で、1 枚 25 MiB 以下
image download returned HTTP 404
image is too large
image Content-Type is not image/*: text/html
reference image URL must not point to an internal address
image is too large, please compress it to under 4MB and retry
# コンテンツセーフティによるブロック (error.code: safety_rejected)
Your request was rejected by the safety system.
# HTTP 413
Request body exceeds the size limit (60 MB)Gemini のエラーメッセージ原文
# 「Gemini 全モデル(画像生成含む)」
prompt must not be empty
n must be between 1 and 10 for model gemini-3-pro-image
n=3 is too large for 4K output on model gemini-3-pro-image; at most 2 images per request at this size (response size limit); lower n or send separate requests
model gemini-3.1-flash-image does not support tier 4K; supported: 1K, 2K
model gemini-3-pro-image: size "big" is not valid; expected WIDTHxHEIGHT (any aspect ratio, mapped to the nearest official tier) or 1K/2K/4K
aspect_ratio "7:3" is not supported for model gemini-3-pro-image; allowed values: 1:1, 2:3, 3:2, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9
image_size "4K" is not supported for model gemini-3.1-flash-image; supported: 1K, 2K
background=transparent is not supported for model gemini-3-pro-image; Gemini image models cannot output transparent images
mask is not supported for Gemini image models; remove mask and describe the region to edit in the prompt
too many reference images: at most 14 are supported for this model, got 15
# 「Gemini 公式ダイレクト」
missing prompt
Gemini image generation does not support stream=true; send a non-streaming request
n must be at most 10
n=6 is too large for 2K output on model gemini-3.1-flash-image; at most 5 images per request at this size (response size limit); lower n or send separate requests
Images generations only accepts a JSON request body: ...
size 4K is not supported for model gemini-3.1-flash-image; supported tiers: 1K, 2K
size "banana" is not valid for model gemini-3-pro-image; use auto, WIDTHxHEIGHT (e.g. 1024x1024, mapped to the nearest supported aspect ratio and capped at the model's largest tier), or one of: 1K, 2K, 4K
image_config.aspect_ratio "7:3" is not supported; allowed values: 1:1, 2:3, 3:2, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9
image_config.image_size "4K" is not supported for model gemini-3.1-flash-image; allowed values: 1K, 2K
mask is not supported for model gemini-3-pro-image; remove mask and describe the region to edit in the prompt
background=transparent is not supported for model gemini-3-pro-image; Gemini image models cannot output transparent images
reference image 1: reference image exceeds the 20MB limit
reference image 1: reference image URL must not point to an internal address
reference image 1: reference image download returned HTTP 404
reference image 1: reference file is not a supported image typeSeedream のエラーメッセージ原文
model seedream-5-0-pro only supports size 1K, 1.5K, 2K or a valid WIDTHxHEIGHT pixel size # 例:"size": "auto"
model seedream-5-0-lite requires the total pixel count of size to be between 3686400 and 16777216
size aspect ratio must be between 1:16 and 16:1
missing prompt
response_format only supports url
only a single output is supported (n=1)
model seedream-4-5 only supports output_format jpeg
optimize_prompt_options must be an object
image must be a URL/data URL string or an array of strings
every item in the image array must be a URL or data URL string
image must not be empty
at most 10 reference images are supported
reference image 1 is invalid: data URL must be base64-encoded
reference image 1 is invalid: unsupported image format image/svg+xml
reference image 1 is invalid: a single image must not exceed 30 MB
image edits require at least one image reference # /v1/images/edits で画像なし
seedream does not accept a traditional mask; ... # /v1/images/edits に "mask" があれば拒否(null でも同じ)