B2BB2B LLM

POST /v1/chat/completions

OpenAI-kompatible chatfullføringer med strømming, verktøy, visjon og modellaliaser.

POST /v1/chat/completions

Forespørsel

curl https://api.model-gate.com/v1/chat/completions \
  -H "Authorization: Bearer mg_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "ch-47",
    "messages": [
      {"role": "user", "content": "Explain this API in one sentence."}
    ],
    "stream": false
  }'

De model kan være en kanonisk ID eller et aktivert alias. Model Gate løser aliaser før prissetting og sender den kanoniske ID-en oppstrøms.

Svar

{
  "id": "chatcmpl_example",
  "object": "chat.completion",
  "model": "claude-opus-4.7",
  "choices": [
    {
      "index": 0,
      "message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 14,
    "completion_tokens": 17,
    "total_tokens": 31
  }
}

Streamingforespørsel

Sett "stream": true. De oppstrøms server-sendte hendelsene sendes gjennom uten å omskrive vellykkede hendelsesnyttelaster.

Asynkron forespørsel

For støttede endepunkter, legg til "async": true med "stream": false. Det umiddelbare svaret er HTTP 202 og inneholder request_id og en Partner API resultatnettadresse.

Feil

Leverandøren ikke-2xx-status, brødtekst og innholdstype sendes gjennom uendret. Lokalt genererte valideringsfeil bruker Model Gate-feilkonvolutten.

StatusBetydningHandling
400Ugyldig forespørselSjekk forespørselens tekst og modell-ID.
401Ugyldig eller frossen nøkkelBekreft eller roter API-nøkkelen.
429Frekvens- eller samtidighetsgrensen er overskredetRespekt Retry-After og prøv på nytt med backoff.
5xxMidlertidig oppstrøms- eller gatewayfeilPrøv idempotente forespørsler på nytt med eksponentiell backoff.