POST /v1/chat/completions
Finalizaciones de chat compatibles con OpenAI con transmisión, herramientas, visión y alias de modelo.
POST /v1/chat/completions
Pedido
curl https://api.model-gate.com/v1/chat/completions \
-H "Authorization: Bearer mg_live_..." \
-H "Content-Type: application/json" \
-d '{
"model": "ch-47",
"messages": [
{"role": "user", "content": "Explain this API in one sentence."}
],
"stream": false
}'
El model puede ser una ID canónica o un alias habilitado. Model Gate resuelve los alias antes de fijar el precio y envía la identificación canónica en sentido ascendente.
Respuesta
{
"id": "chatcmpl_example",
"object": "chat.completion",
"model": "claude-opus-4.7",
"choices": [
{
"index": 0,
"message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 14,
"completion_tokens": 17,
"total_tokens": 31
}
}
Solicitud de transmisión
Colocar "stream": true. Los eventos enviados por el servidor ascendentes se pasan sin reescribir las cargas útiles de eventos exitosas.
Solicitud asincrónica
Para puntos finales compatibles, agregue "async": true con "stream": false. La respuesta inmediata es HTTP. 202 y contiene request_id y una URL de resultado Partner API.
Errores
El estado, el cuerpo y el tipo de contenido del proveedor que no es 2xx se pasan sin cambios. Los errores de validación generados localmente utilizan el sobre de error de Model Gate.
| Estado | Significado | Acción |
|---|---|---|
400 | Solicitud no válida | Verifique el cuerpo de la solicitud y el ID del modelo. |
401 | Clave no válida o congelada | Verifique o rote la clave API. |
429 | Se superó el límite de tasa o simultaneidad | Respeto Retry-After y vuelva a intentarlo con retroceso. |
5xx | Error temporal de subida o de puerta de enlace | Vuelva a intentar solicitudes idempotentes con retroceso exponencial. |