B2BB2B LLM

POST /v1/chat/completions

OpenAI-compatibele chat-voltooiingen met streaming, tools, visie en modelaliassen.

POST /v1/chat/completions

Verzoek

curl https://api.model-gate.com/v1/chat/completions \
  -H "Authorization: Bearer mg_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "ch-47",
    "messages": [
      {"role": "user", "content": "Explain this API in one sentence."}
    ],
    "stream": false
  }'

De model kan een canonieke ID of een ingeschakelde alias zijn. Model Gate lost aliassen op vóór de prijsstelling en verzendt de canonieke ID stroomopwaarts.

Antwoord

{
  "id": "chatcmpl_example",
  "object": "chat.completion",
  "model": "claude-opus-4.7",
  "choices": [
    {
      "index": 0,
      "message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 14,
    "completion_tokens": 17,
    "total_tokens": 31
  }
}

Streamingverzoek

Set "stream": true. De upstream door de server verzonden gebeurtenissen worden doorgegeven zonder de succesvolle gebeurtenispayloads te herschrijven.

Asynchrone aanvraag

Voor ondersteunde eindpunten voegt u toe "async": true met "stream": false. Het onmiddellijke antwoord is HTTP 202 en bevat request_id en een Partner API resultaat-URL.

Fouten

Status, body en contenttype van de provider non-2xx worden ongewijzigd doorgegeven. Lokaal gegenereerde validatiefouten gebruiken de Model Gate-foutenvelop.

StatusBetekenisActie
400Ongeldig verzoekControleer de hoofdtekst van het verzoek en de model-ID.
401Ongeldige of bevroren sleutelControleer of roteer de API-sleutel.
429Tarief- of gelijktijdigheidslimiet overschredenRespect Retry-After en probeer het opnieuw met uitstel.
5xxTijdelijke upstream- of gatewayfoutProbeer idempotente aanvragen opnieuw met exponentieel uitstel.