Saltar al contenido

Crear una completion de chat

Chat Completions compatible con OpenAI: GPT, Gemini, GLM, Qwen, DeepSeek, Grok y otros modelos de chat comparten este endpoint.

POST/v1/chat/completions

Recibe una lista de mensajes de conversación y devuelve la respuesta del modelo. Con el SDK de OpenAI solo cambie el Base URL a https://api.hop-base.com/v1 y use la clave del grupo correspondiente.

La tabla solo incluye los campos que el gateway comprueba, reescribe o rechaza, y los valores indicados en cada página de modelo; los demás campos de OpenAI se reenvían sin cambios y sus rangos siguen la especificación oficial del modelo. El cuerpo completo de la solicitud admite hasta 60 MB; si lo supera, devuelve 413.

Encabezados

Authorization:obligatoriostring

Bearer sk-…: una clave de API creada en la consola; su grupo debe incluir el modelo solicitado

Parámetros del cuerpoJSON

Modelo
Los campos no listados se reenvían sin cambios. Elige una familia de modelos para ver los valores y límites que indica su documentación.
model:obligatoriostring

Un ID de modelo del grupo de la clave actual, según lo que devuelve GET /v1/models. Si el grupo no incluye el modelo, devuelve 404 model_not_found; los modelos de imagen como gpt-image-* devuelven 400 image models do not support Chat Completions, please use the Images API en este endpoint

messages:obligatorioarray of object

Mensajes de la conversación. Si falta devuelve 400 missing messages field; un array vacío devuelve 400 messages must not be an empty array

Elementos≥ 1

max_tokens:opcionalinteger

Límite de salida. El gateway no lo recorta ni lo reescribe; el máximo sigue la especificación oficial del modelo y, si se supera, el modelo devuelve un error

max_completion_tokens:opcionalinteger

Igual que max_tokens; nombre de campo más reciente de OpenAI

stream:opcionalboolean

true devuelve SSE; formato de eventos en Eventos de streaming

Predeterminadofalse

stream_options:opcionalobject

Opciones de streaming

tools:opcionalarray of object

Herramientas de función en formato de function tools de OpenAI; se reenvían sin cambios.

tool_choice:opcionalstring o object

auto / none / required o una función concreta; se reenvía sin cambios

temperature:opcionalnumber

Temperatura de muestreo; se reenvía sin cambios, con el rango de la especificación oficial del modelo

top_p:opcionalnumber

Muestreo de núcleo; se reenvía sin cambios, con el rango de la especificación oficial del modelo

reasoning_effort:opcionalstring

Nivel de razonamiento. Los valores varían según el modelo; elija la familia de modelos arriba para verlos

service_tier:opcionalstring

Solo se conservan priority / flex; los demás valores se eliminan antes de reenviar, sin error

Valorespriorityflex

Respuesta

200Éxito. Sin streaming es un JSON chat.completion; con stream: true es SSE (text/event-stream)

id:opcionalstring

ID de esta completion

object:opcional"chat.completion"

Siempre chat.completion

created:opcionalinteger

Segundos Unix

model:opcionalstring

ID del modelo usado realmente

choices:opcionalarray of object

Respuestas candidatas; la mayoría de los modelos devuelve solo 1

usage:opcionalobject

Uso de tokens

Errores

400No se puede leer el cuerpo de la solicitud, falta messages, etc.
401Falta la clave, la clave no es válida o ha caducado (missing_api_key / invalid_api_key / api_key_expired)
402Se agotó el saldo o la cuota de la clave, del miembro o del departamento (insufficient_quota)
404El modelo no está en el grupo de esta clave (model_not_found) o la ruta no pertenece a ese grupo (route_not_found)
413El cuerpo de la solicitud supera 60 MB (request_too_large)
429Se alcanzó el límite de concurrencia de la cuenta o de la clave (user_concurrency_limit / apikey_concurrency_limit), con Retry-After

Páginas relacionadas