Grok
Llame a los modelos de chat, razonamiento e imagen de Grok de xAI mediante la API compatible con OpenAI de HopBase, incluidos el precio de contexto largo, la facturación de tokens de razonamiento y el cargo por herramientas del servidor.
Los modelos Grok de xAI se ofrecen mediante el protocolo compatible con OpenAI de HopBase. Use https://api.hop-base.com/v1 y el ID de modelo exacto que devuelve GET /v1/models. No hay alias ni nombres abreviados registrados.
El video de Grok (grok-imagine-video-1.5) pertenece a otro grupo de plan y usa la API de tareas asíncronas; consulte Generación de video.
Modelos de chat y razonamiento
| ID de modelo | Ventana de contexto |
|---|---|
grok-4.6 | 500K |
grok-4.5 | 500K |
grok-4.3 | 1M |
grok-4.20-0309-reasoning | 2M |
grok-4.20-multi-agent-0309 | 2M |
Tanto POST /v1/chat/completions como POST /v1/responses están disponibles, así que Codex CLI y cualquier cliente del SDK de OpenAI pueden llegar a estos modelos.
Multiagente solo admite Responses
grok-4.20-multi-agent-0309 solo admite Responses por diseño de xAI. Llamarlo mediante chat/completions devuelve un error explícito del proveedor: es una restricción del propio modelo, no de la pasarela, así que el texto del error viene de xAI.
Solicitudes de contexto largo
Una solicitud cuya entrada supera los 200.000 tokens se trata como solicitud de contexto largo.
- El umbral cuenta la entrada no almacenada en caché más la entrada en caché. Los tokens de salida no cuentan.
- Una solicitud que se queda exactamente en 200.000 tokens no lo cruza; hace falta un token más.
- Las solicitudes afectadas se marcan como
long_contexten su registro de uso, para poder distinguirlas.
Tokens de razonamiento en la respuesta
Grok es una familia de razonamiento, y los dos endpoints informan el razonamiento de forma distinta. Esto importa al leer usage de forma programática.
| Endpoint | Campo de salida | ¿Incluye razonamiento? |
|---|---|---|
/v1/chat/completions | completion_tokens | No: el razonamiento se informa aparte en completion_tokens_details.reasoning_tokens |
/v1/responses | output_tokens | Sí |
HopBase transmite el cuerpo de la respuesta del proveedor sin cambios, así que en chat/completions una sola respuesta puede informar completion_tokens: 1 con reasoning_tokens: 158. Sume ambos para obtener la longitud real de salida; en /v1/responses ya está incluido.
Si lee el uso desde una respuesta en streaming, tenga en cuenta que este proveedor a veces emite campos espejo input_tokens y output_tokens fijados en cero en el bloque final de uso. HopBase los rellena a partir de los campos estándar cuando ocurre.
Herramientas del servidor
Grok puede llamar a herramientas integradas del servidor durante una solicitud: búsqueda web, búsqueda en X, intérprete de código, búsqueda de documentos y búsqueda de archivos. Las llamadas MCP van a su propio servicio remoto.
El número de llamadas a herramientas que hizo una solicitud aparece en su registro de uso, desglosado por tipo.
Modelos de imagen
Los modelos de imagen de Grok usan la API de imágenes estándar de OpenAI, no el chat.
| Endpoint | Propósito |
|---|---|
POST /v1/images/generations | Texto a imagen |
POST /v1/images/edits | Imagen a imagen, con imágenes de referencia |
| ID de modelo | Resoluciones |
|---|---|
grok-imagine-image | 1k; una solicitud 2k se acepta y se produce a 1k |
grok-imagine-image-2.0 | 1k / 2k |
grok-imagine-image-quality | 1k / 2k |
Parámetros
| Parámetro | Notas |
|---|---|
prompt | Obligatorio |
model | Obligatorio, ID exacto |
n | Opcional, 1 por defecto |
resolution | 1k o 2k, 1k por defecto. 4k se rechaza con un 400 |
image | Solo en edits. Una URL, un arreglo de URL o { "url": ... }. Máximo 2 imágenes de referencia |
mask | No admitido: se rechaza con un 400 |
Las respuestas devuelven URL de imagen. Subir con el SDK de OpenAI funciona: el endpoint de edits de xAI acepta JSON en lugar de multipart, y HopBase reescribe la solicitud multipart al formato que el proveedor espera.
Forma de la respuesta
Las respuestas devuelven URL de imagen. Una respuesta vacía significa que no se produjo nada. Las respuestas de imagen no llevan consumo de tokens.
curl
# Chat
curl https://api.hop-base.com/v1/chat/completions \
-H "Authorization: Bearer sk-your-key" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.6",
"messages": [{ "role": "user", "content": "Resuma los riesgos de este trimestre en cinco puntos." }]
}'
# Texto a imagen
curl https://api.hop-base.com/v1/images/generations \
-H "Authorization: Bearer sk-your-key" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-imagine-image-2.0",
"prompt": "Un gato naranja dormido en el alféizar soleado, fotografía editorial",
"resolution": "2k",
"n": 1
}'Selección de grupo
Los modelos de chat e imagen los sirve el grupo de plan Grok 全系; el video lo sirve Grok 视频. Una clave está vinculada a un solo grupo, así que una clave que llega a los modelos de chat no llega al modelo de video. Compruebe GET /v1/models con la clave que vaya a usar y consulte sus tarifas efectivas en el catálogo de modelos con la sesión iniciada.