POST /v1/chat/completions
OpenAI-kompatible Chat-Vervollständigungen mit Streaming, Tools, Vision und Modellaliasen.
POST /v1/chat/completions
Anfrage
curl https://api.model-gate.com/v1/chat/completions \
-H "Authorization: Bearer mg_live_..." \
-H "Content-Type: application/json" \
-d '{
"model": "ch-47",
"messages": [
{"role": "user", "content": "Explain this API in one sentence."}
],
"stream": false
}'
Der model kann eine kanonische ID oder ein aktivierter Alias sein. Model Gate löst Aliase vor der Preisfestsetzung auf und sendet die kanonische ID an den Upstream.
Antwort
{
"id": "chatcmpl_example",
"object": "chat.completion",
"model": "claude-opus-4.7",
"choices": [
{
"index": 0,
"message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 14,
"completion_tokens": 17,
"total_tokens": 31
}
}
Streaming-Anfrage
Satz "stream": true. Die vom Upstream-Server gesendeten Ereignisse werden weitergeleitet, ohne dass erfolgreiche Ereignisnutzlasten neu geschrieben werden.
Asynchrone Anfrage
Fügen Sie für unterstützte Endpunkte hinzu "async": true mit "stream": false. Die unmittelbare Antwort ist HTTP 202 und enthält request_id und eine Partner API Ergebnis-URL.
Fehler
Der Nicht-2xx-Status, der Textkörper und der Inhaltstyp des Anbieters werden unverändert weitergegeben. Lokal generierte Validierungsfehler verwenden den Model Gate-Fehlerumschlag.
| Status | Bedeutung | Aktion |
|---|---|---|
400 | Ungültige Anfrage | Überprüfen Sie den Anfragetext und die Modell-ID. |
401 | Ungültiger oder eingefrorener Schlüssel | Überprüfen oder rotieren Sie den API-Schlüssel. |
429 | Raten- oder Parallelitätslimit überschritten | Respektieren Retry-After und versuchen Sie es erneut mit Backoff. |
5xx | Vorübergehender Upstream- oder Gateway-Fehler | Wiederholen Sie idempotente Anfragen mit exponentiellem Backoff. |