B2BB2B LLM

POST /v1/chat/completions

OpenAI-kompatible chatafslutninger med streaming, værktøjer, vision og modelaliasser.

POST /v1/chat/completions

Anmodning

curl https://api.model-gate.com/v1/chat/completions \
  -H "Authorization: Bearer mg_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "ch-47",
    "messages": [
      {"role": "user", "content": "Explain this API in one sentence."}
    ],
    "stream": false
  }'

De model kan være et kanonisk id eller et aktiveret alias. Model Gate løser aliaser før prissætning og sender det kanoniske ID opstrøms.

Svar

{
  "id": "chatcmpl_example",
  "object": "chat.completion",
  "model": "claude-opus-4.7",
  "choices": [
    {
      "index": 0,
      "message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 14,
    "completion_tokens": 17,
    "total_tokens": 31
  }
}

Streaming anmodning

Sæt "stream": true. De opstrøms server-sendte hændelser sendes igennem uden omskrivning af succesfulde hændelsesdata.

Asynkron anmodning

For understøttede slutpunkter, tilføj "async": true med "stream": false. Det umiddelbare svar er HTTP 202 og indeholder request_id og en Partner API resultatwebadresse.

Fejl

Udbyder ikke-2xx-status, brødtekst og indholdstype videregives uændret. Lokalt genererede valideringsfejl bruger Model Gate-fejlkonvolutten.

StatusMeningHandling
400Ugyldig anmodningTjek anmodningens krop og model-id.
401Ugyldig eller fastfrosset nøgleBekræft eller drej API-nøglen.
429Sats- eller samtidighedsgrænsen er overskredetRespekt Retry-After og prøv igen med backoff.
5xxMidlertidig upstream- eller gateway-fejlPrøv igen idempotente anmodninger med eksponentiel backoff.