POST /v1/chat/completions
Finalizări de chat compatibile cu OpenAI cu streaming, instrumente, viziune și aliasuri de model.
POST /v1/chat/completions
Cerere
curl https://api.model-gate.com/v1/chat/completions \
-H "Authorization: Bearer mg_live_..." \
-H "Content-Type: application/json" \
-d '{
"model": "ch-47",
"messages": [
{"role": "user", "content": "Explain this API in one sentence."}
],
"stream": false
}'
The model poate fi un ID canonic sau un alias activat. Model Gate rezolvă aliasurile înainte de stabilirea prețului și trimite ID-ul canonic în amonte.
Răspuns
{
"id": "chatcmpl_example",
"object": "chat.completion",
"model": "claude-opus-4.7",
"choices": [
{
"index": 0,
"message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 14,
"completion_tokens": 17,
"total_tokens": 31
}
}
Solicitare de streaming
Set "stream": true. Evenimentele trimise de server din amonte sunt transmise fără a rescrie încărcăturile utile de evenimente cu succes.
Cerere asincronă
Pentru punctele finale acceptate, adăugați "async": true cu "stream": false. Răspunsul imediat este HTTP 202 si contine request_id și o adresă URL de rezultat Partner API.
Erori
Starea furnizorului non-2xx, corpul și tipul de conținut sunt transmise neschimbate. Erorile de validare generate local folosesc pachetul de eroare Model Gate.
| Stare | Sens | Acţiune |
|---|---|---|
400 | Solicitare nevalidă | Verificați corpul cererii și ID-ul modelului. |
401 | Cheie nevalidă sau înghețată | Verificați sau rotiți cheia API. |
429 | Limita ratei sau concurenței a fost depășită | Respect Retry-After și reîncercați cu backoff. |
5xx | Eroare temporară în amonte sau gateway | Reîncercați solicitările idempotente cu backoff exponențial. |