POST /v1/chat/completions
OpenAI-kompatible chatfullføringer med strømming, verktøy, visjon og modellaliaser.
POST /v1/chat/completions
Forespørsel
curl https://api.model-gate.com/v1/chat/completions \
-H "Authorization: Bearer mg_live_..." \
-H "Content-Type: application/json" \
-d '{
"model": "ch-47",
"messages": [
{"role": "user", "content": "Explain this API in one sentence."}
],
"stream": false
}'
De model kan være en kanonisk ID eller et aktivert alias. Model Gate løser aliaser før prissetting og sender den kanoniske ID-en oppstrøms.
Svar
{
"id": "chatcmpl_example",
"object": "chat.completion",
"model": "claude-opus-4.7",
"choices": [
{
"index": 0,
"message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 14,
"completion_tokens": 17,
"total_tokens": 31
}
}
Streamingforespørsel
Sett "stream": true. De oppstrøms server-sendte hendelsene sendes gjennom uten å omskrive vellykkede hendelsesnyttelaster.
Asynkron forespørsel
For støttede endepunkter, legg til "async": true med "stream": false. Det umiddelbare svaret er HTTP 202 og inneholder request_id og en Partner API resultatnettadresse.
Feil
Leverandøren ikke-2xx-status, brødtekst og innholdstype sendes gjennom uendret. Lokalt genererte valideringsfeil bruker Model Gate-feilkonvolutten.
| Status | Betydning | Handling |
|---|---|---|
400 | Ugyldig forespørsel | Sjekk forespørselens tekst og modell-ID. |
401 | Ugyldig eller frossen nøkkel | Bekreft eller roter API-nøkkelen. |
429 | Frekvens- eller samtidighetsgrensen er overskredet | Respekt Retry-After og prøv på nytt med backoff. |
5xx | Midlertidig oppstrøms- eller gatewayfeil | Prøv idempotente forespørsler på nytt med eksponentiell backoff. |