POST /v1/chat/completions
OpenAI-kompatibla chattkompletteringar med streaming, verktyg, vision och modellalias.
POST /v1/chat/completions
Begäran
curl https://api.model-gate.com/v1/chat/completions \
-H "Authorization: Bearer mg_live_..." \
-H "Content-Type: application/json" \
-d '{
"model": "ch-47",
"messages": [
{"role": "user", "content": "Explain this API in one sentence."}
],
"stream": false
}'
De model kan vara ett kanoniskt ID eller ett aktiverat alias. Model Gate löser alias före prissättning och skickar det kanoniska ID:t uppströms.
Svar
{
"id": "chatcmpl_example",
"object": "chat.completion",
"model": "claude-opus-4.7",
"choices": [
{
"index": 0,
"message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 14,
"completion_tokens": 17,
"total_tokens": 31
}
}
Streamingförfrågan
Uppsättning "stream": true. De uppströms serversända händelserna skickas igenom utan omskrivning av framgångsrika händelsenyttolaster.
Asynkron begäran
För slutpunkter som stöds, lägg till "async": true med "stream": false. Det omedelbara svaret är HTTP 202 och innehåller request_id och en Partner API resultatwebbadress.
Fel
Leverantör icke-2xx status, text och innehållstyp skickas igenom oförändrade. Lokalt genererade valideringsfel använder Model Gate-felenveloppen.
| Status | Menande | Handling |
|---|---|---|
400 | Ogiltig begäran | Kontrollera förfrågans innehåll och modell-ID. |
401 | Ogiltig eller fryst nyckel | Verifiera eller rotera API-nyckeln. |
429 | Belopps- eller samtidighetsgränsen har överskridits | Respektera Retry-After och försök igen med backoff. |
5xx | Tillfälligt uppströms- eller gateway-fel | Försök med idempotenta förfrågningar igen med exponentiell backoff. |