本文へスキップ

モデル

すべての公開モデルの公式価格、主な上限、利用可能なグループを掲載しています。各モデルを開くと完全な仕様を確認できます。

Claude

10

Anthropic プロトコルのネイティブモデル。Claude Code と Messages API でそのまま使えます。

GPT Image

3

トークン課金。マスク(mask)による部分編集に対応する唯一の画像生成ファミリーで、透過背景も出力できます。

GPT

10

Codex と OpenAI SDK のネイティブモデル。Responses と Chat Completions の両方で使えます。

Gemini

1

同期で動画を生成する唯一のモデル。1 回のリクエストで MP4 を直接返し、ポーリングは不要です。

Gemini Image

5

アスペクト比を指定して生成。参照画像は最大 14 枚で、納品枚数で課金されます。

Gemini

13

OpenAI Chat Completions 互換。1 つのキーで Flash、Lite、Pro の全シリーズを利用できます。

GLM

2

1M コンテキスト、思考は常時有効。Chat Completions と Responses の両方で使えます。

Qwen

5

5 モデルとも 1M コンテキスト、最大出力 131,072。1 つのグループですべて使えます。

DeepSeek

3

1M コンテキストの推論モデル。思考のオン / オフを切り替えられ、プレフィックス補完にも対応します。

Grok Imagine

1

秒単位の課金でテキストから動画を生成。参照画像も追加でき、長さは 1–15 秒です。

Grok Imagine

3

1 枚単位の価格で 1k / 2k の 2 段階。編集では参照画像を最大 2 枚使えます。

Grok

5

コンテキストは最長 2M、推論は常時有効。Chat Completions と Responses の両方で使えます。

Seedream

3

1 枚単位の価格で同期生成のみ、1 回 1 枚。2K–4K の大きな画像に向いています。

Seedance

14

テキストから動画、マルチモーダル参照から動画。4K に対応するのは海外版 2.0 標準版のみです。

Kling 画像

7

非同期で画像を生成し、参照画像は最大 10 枚。画像から画像、複数画像参照、アウトペインティング専用のモデルもあります。

Kling

13

秒単位の課金。先頭・末尾フレーム、サブジェクト参照、モーションコントロール、アバター、リップシンクに対応します。

Midjourney

1

1 タスクで常に 4 枚を生成。アスペクト比とスタイルのパラメーターはプロンプトに書きます。

MiniMax Speech

2

同期のテキスト読み上げ。文字数で課金され、システムボイスとボイスクローンに対応します。

MiniMax Hailuo

2

24 FPS でネイティブのステレオ音声付き動画を生成。セリフやナレーションも映像と一緒に生成されます。

Wan · HappyHorse

4

Wan と HappyHorse:ネイティブのタスク API で、秒単位の課金、最長 30 秒。

価格は公式価格(米ドル)です。実際の課金額 = 公式価格 × グループの倍率で、正確な金額はコンソールの「使用履歴」で確認できます。