B2BB2B LLM

POST /v1/chat/completions

OpenAI-kompatibla chattkompletteringar med streaming, verktyg, vision och modellalias.

POST /v1/chat/completions

Begäran

curl https://api.model-gate.com/v1/chat/completions \
  -H "Authorization: Bearer mg_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "ch-47",
    "messages": [
      {"role": "user", "content": "Explain this API in one sentence."}
    ],
    "stream": false
  }'

De model kan vara ett kanoniskt ID eller ett aktiverat alias. Model Gate löser alias före prissättning och skickar det kanoniska ID:t uppströms.

Svar

{
  "id": "chatcmpl_example",
  "object": "chat.completion",
  "model": "claude-opus-4.7",
  "choices": [
    {
      "index": 0,
      "message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 14,
    "completion_tokens": 17,
    "total_tokens": 31
  }
}

Streamingförfrågan

Uppsättning "stream": true. De uppströms serversända händelserna skickas igenom utan omskrivning av framgångsrika händelsenyttolaster.

Asynkron begäran

För slutpunkter som stöds, lägg till "async": true med "stream": false. Det omedelbara svaret är HTTP 202 och innehåller request_id och en Partner API resultatwebbadress.

Fel

Leverantör icke-2xx status, text och innehållstyp skickas igenom oförändrade. Lokalt genererade valideringsfel använder Model Gate-felenveloppen.

StatusMenandeHandling
400Ogiltig begäranKontrollera förfrågans innehåll och modell-ID.
401Ogiltig eller fryst nyckelVerifiera eller rotera API-nyckeln.
429Belopps- eller samtidighetsgränsen har överskriditsRespektera Retry-After och försök igen med backoff.
5xxTillfälligt uppströms- eller gateway-felFörsök med idempotenta förfrågningar igen med exponentiell backoff.