Grok

Llame a los modelos de chat, razonamiento e imagen de Grok de xAI mediante la API compatible con OpenAI de HopBase, incluidos el precio de contexto largo, la facturación de tokens de razonamiento y el cargo por herramientas del servidor.

Los modelos Grok de xAI se ofrecen mediante el protocolo compatible con OpenAI de HopBase. Use https://api.hop-base.com/v1 y el ID de modelo exacto que devuelve GET /v1/models. No hay alias ni nombres abreviados registrados.

El video de Grok (grok-imagine-video-1.5) pertenece a otro grupo de plan y usa la API de tareas asíncronas; consulte Generación de video.

Modelos de chat y razonamiento

ID de modeloVentana de contexto
grok-4.6500K
grok-4.5500K
grok-4.31M
grok-4.20-0309-reasoning2M
grok-4.20-multi-agent-03092M

Tanto POST /v1/chat/completions como POST /v1/responses están disponibles, así que Codex CLI y cualquier cliente del SDK de OpenAI pueden llegar a estos modelos.

Multiagente solo admite Responses

grok-4.20-multi-agent-0309 solo admite Responses por diseño de xAI. Llamarlo mediante chat/completions devuelve un error explícito del proveedor: es una restricción del propio modelo, no de la pasarela, así que el texto del error viene de xAI.

Solicitudes de contexto largo

Una solicitud cuya entrada supera los 200.000 tokens se trata como solicitud de contexto largo.

  • El umbral cuenta la entrada no almacenada en caché más la entrada en caché. Los tokens de salida no cuentan.
  • Una solicitud que se queda exactamente en 200.000 tokens no lo cruza; hace falta un token más.
  • Las solicitudes afectadas se marcan como long_context en su registro de uso, para poder distinguirlas.

Tokens de razonamiento en la respuesta

Grok es una familia de razonamiento, y los dos endpoints informan el razonamiento de forma distinta. Esto importa al leer usage de forma programática.

EndpointCampo de salida¿Incluye razonamiento?
/v1/chat/completionscompletion_tokensNo: el razonamiento se informa aparte en completion_tokens_details.reasoning_tokens
/v1/responsesoutput_tokens

HopBase transmite el cuerpo de la respuesta del proveedor sin cambios, así que en chat/completions una sola respuesta puede informar completion_tokens: 1 con reasoning_tokens: 158. Sume ambos para obtener la longitud real de salida; en /v1/responses ya está incluido.

Si lee el uso desde una respuesta en streaming, tenga en cuenta que este proveedor a veces emite campos espejo input_tokens y output_tokens fijados en cero en el bloque final de uso. HopBase los rellena a partir de los campos estándar cuando ocurre.

Herramientas del servidor

Grok puede llamar a herramientas integradas del servidor durante una solicitud: búsqueda web, búsqueda en X, intérprete de código, búsqueda de documentos y búsqueda de archivos. Las llamadas MCP van a su propio servicio remoto.

El número de llamadas a herramientas que hizo una solicitud aparece en su registro de uso, desglosado por tipo.

Modelos de imagen

Los modelos de imagen de Grok usan la API de imágenes estándar de OpenAI, no el chat.

EndpointPropósito
POST /v1/images/generationsTexto a imagen
POST /v1/images/editsImagen a imagen, con imágenes de referencia
ID de modeloResoluciones
grok-imagine-image1k; una solicitud 2k se acepta y se produce a 1k
grok-imagine-image-2.01k / 2k
grok-imagine-image-quality1k / 2k

Parámetros

ParámetroNotas
promptObligatorio
modelObligatorio, ID exacto
nOpcional, 1 por defecto
resolution1k o 2k, 1k por defecto. 4k se rechaza con un 400
imageSolo en edits. Una URL, un arreglo de URL o { "url": ... }. Máximo 2 imágenes de referencia
maskNo admitido: se rechaza con un 400

Las respuestas devuelven URL de imagen. Subir con el SDK de OpenAI funciona: el endpoint de edits de xAI acepta JSON en lugar de multipart, y HopBase reescribe la solicitud multipart al formato que el proveedor espera.

Forma de la respuesta

Las respuestas devuelven URL de imagen. Una respuesta vacía significa que no se produjo nada. Las respuestas de imagen no llevan consumo de tokens.

curl

# Chat
curl https://api.hop-base.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.6",
    "messages": [{ "role": "user", "content": "Resuma los riesgos de este trimestre en cinco puntos." }]
  }'

# Texto a imagen
curl https://api.hop-base.com/v1/images/generations \
  -H "Authorization: Bearer sk-your-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-imagine-image-2.0",
    "prompt": "Un gato naranja dormido en el alféizar soleado, fotografía editorial",
    "resolution": "2k",
    "n": 1
  }'

Selección de grupo

Los modelos de chat e imagen los sirve el grupo de plan Grok 全系; el video lo sirve Grok 视频. Una clave está vinculada a un solo grupo, así que una clave que llega a los modelos de chat no llega al modelo de video. Compruebe GET /v1/models con la clave que vaya a usar y consulte sus tarifas efectivas en el catálogo de modelos con la sesión iniciada.

En esta página