Saltar al contenido

Modelos

Precio oficial, límites clave y grupos disponibles de todos los modelos públicos. Abra cualquier modelo para ver sus especificaciones completas.

Claude

10

Modelos nativos del protocolo Anthropic; funcionan directamente con Claude Code y la Messages API.

GPT Image

3

Se factura por tokens; es la única familia de imagen que admite edición local con máscara (mask) y puede generar fondos transparentes.

GPT

10

Modelos nativos de Codex y del SDK de OpenAI; admiten Responses y Chat Completions.

Gemini

1

El único modelo que genera video de forma síncrona: una solicitud devuelve el MP4 directamente, sin consultas periódicas.

Gemini Image

5

Genera por relación de aspecto, admite hasta 14 imágenes de referencia y se factura por imagen entregada.

Gemini

13

Compatible con OpenAI Chat Completions; una sola clave cubre toda la gama Flash, Lite y Pro.

GLM

2

Contexto de 1M, razonamiento siempre activo; admite Chat Completions y Responses.

Qwen

5

Los cinco modelos tienen contexto de 1M y salida máxima de 131,072, todos disponibles en un solo grupo.

DeepSeek

3

Modelos de razonamiento con contexto de 1M; el razonamiento se puede activar o desactivar y admiten continuación de prefijo.

Grok Imagine

1

Texto a video facturado por segundo, con imágenes de referencia opcionales y una duración de 1–15 segundos.

Grok Imagine

3

Precio por imagen, dos niveles (1k / 2k) y hasta 2 imágenes de referencia para editar.

Grok

5

Contexto de hasta 2M, razonamiento siempre activo; admite Chat Completions y Responses.

Seedream

3

Precio por imagen, solo síncrono y 1 imagen por solicitud; indicado para imágenes grandes de 2K–4K.

Seedance

14

Texto a video y video con referencias multimodales; la versión estándar internacional 2.0 es la única que admite 4K.

Kling Imagen

7

Generación de imágenes asíncrona con hasta 10 imágenes de referencia, más modelos específicos para imagen a imagen, referencia múltiple y ampliación de imagen.

Kling

13

Se factura por segundo; cubre primer y último fotograma, referencia de sujeto, control de movimiento, avatar y sincronización labial.

Midjourney

1

Cada tarea genera siempre 4 imágenes; la relación de aspecto y los parámetros de estilo van en el prompt.

MiniMax Speech

2

Texto a voz síncrono facturado por caracteres; admite voces oficiales y clonación de voz.

MiniMax Hailuo

2

Video a 24 FPS con estéreo nativo; los diálogos y la narración se generan junto con la imagen.

Wan · HappyHorse

4

Wan y HappyHorse: API de tareas nativa, facturación por segundo y hasta 30 segundos de duración.

Precios oficiales en USD. Cargo real = precio oficial × multiplicador del grupo; consulte el registro de uso de la consola para ver los cargos exactos.