B2BB2B LLM

POST /v1/chat/completions

Finalizaciones de chat compatibles con OpenAI con transmisión, herramientas, visión y alias de modelo.

POST /v1/chat/completions

Pedido

curl https://api.model-gate.com/v1/chat/completions \
  -H "Authorization: Bearer mg_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "ch-47",
    "messages": [
      {"role": "user", "content": "Explain this API in one sentence."}
    ],
    "stream": false
  }'

El model puede ser una ID canónica o un alias habilitado. Model Gate resuelve los alias antes de fijar el precio y envía la identificación canónica en sentido ascendente.

Respuesta

{
  "id": "chatcmpl_example",
  "object": "chat.completion",
  "model": "claude-opus-4.7",
  "choices": [
    {
      "index": 0,
      "message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 14,
    "completion_tokens": 17,
    "total_tokens": 31
  }
}

Solicitud de transmisión

Colocar "stream": true. Los eventos enviados por el servidor ascendentes se pasan sin reescribir las cargas útiles de eventos exitosas.

Solicitud asincrónica

Para puntos finales compatibles, agregue "async": true con "stream": false. La respuesta inmediata es HTTP. 202 y contiene request_id y una URL de resultado Partner API.

Errores

El estado, el cuerpo y el tipo de contenido del proveedor que no es 2xx se pasan sin cambios. Los errores de validación generados localmente utilizan el sobre de error de Model Gate.

EstadoSignificadoAcción
400Solicitud no válidaVerifique el cuerpo de la solicitud y el ID del modelo.
401Clave no válida o congeladaVerifique o rote la clave API.
429Se superó el límite de tasa o simultaneidadRespeto Retry-After y vuelva a intentarlo con retroceso.
5xxError temporal de subida o de puerta de enlaceVuelva a intentar solicitudes idempotentes con retroceso exponencial.