B2BB2B LLM

POST /v1/chat/completions

Finalizări de chat compatibile cu OpenAI cu streaming, instrumente, viziune și aliasuri de model.

POST /v1/chat/completions

Cerere

curl https://api.model-gate.com/v1/chat/completions \
  -H "Authorization: Bearer mg_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "ch-47",
    "messages": [
      {"role": "user", "content": "Explain this API in one sentence."}
    ],
    "stream": false
  }'

The model poate fi un ID canonic sau un alias activat. Model Gate rezolvă aliasurile înainte de stabilirea prețului și trimite ID-ul canonic în amonte.

Răspuns

{
  "id": "chatcmpl_example",
  "object": "chat.completion",
  "model": "claude-opus-4.7",
  "choices": [
    {
      "index": 0,
      "message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 14,
    "completion_tokens": 17,
    "total_tokens": 31
  }
}

Solicitare de streaming

Set "stream": true. Evenimentele trimise de server din amonte sunt transmise fără a rescrie încărcăturile utile de evenimente cu succes.

Cerere asincronă

Pentru punctele finale acceptate, adăugați "async": true cu "stream": false. Răspunsul imediat este HTTP 202 si contine request_id și o adresă URL de rezultat Partner API.

Erori

Starea furnizorului non-2xx, corpul și tipul de conținut sunt transmise neschimbate. Erorile de validare generate local folosesc pachetul de eroare Model Gate.

StareSensAcţiune
400Solicitare nevalidăVerificați corpul cererii și ID-ul modelului.
401Cheie nevalidă sau înghețatăVerificați sau rotiți cheia API.
429Limita ratei sau concurenței a fost depășităRespect Retry-After și reîncercați cu backoff.
5xxEroare temporară în amonte sau gatewayReîncercați solicitările idempotente cu backoff exponențial.