B2BB2B LLM

POST /v1/chat/completions

OpenAI-kompatible Chat-Vervollständigungen mit Streaming, Tools, Vision und Modellaliasen.

POST /v1/chat/completions

Anfrage

curl https://api.model-gate.com/v1/chat/completions \
  -H "Authorization: Bearer mg_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "ch-47",
    "messages": [
      {"role": "user", "content": "Explain this API in one sentence."}
    ],
    "stream": false
  }'

Der model kann eine kanonische ID oder ein aktivierter Alias ​​sein. Model Gate löst Aliase vor der Preisfestsetzung auf und sendet die kanonische ID an den Upstream.

Antwort

{
  "id": "chatcmpl_example",
  "object": "chat.completion",
  "model": "claude-opus-4.7",
  "choices": [
    {
      "index": 0,
      "message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 14,
    "completion_tokens": 17,
    "total_tokens": 31
  }
}

Streaming-Anfrage

Satz "stream": true. Die vom Upstream-Server gesendeten Ereignisse werden weitergeleitet, ohne dass erfolgreiche Ereignisnutzlasten neu geschrieben werden.

Asynchrone Anfrage

Fügen Sie für unterstützte Endpunkte hinzu "async": true mit "stream": false. Die unmittelbare Antwort ist HTTP 202 und enthält request_id und eine Partner API Ergebnis-URL.

Fehler

Der Nicht-2xx-Status, der Textkörper und der Inhaltstyp des Anbieters werden unverändert weitergegeben. Lokal generierte Validierungsfehler verwenden den Model Gate-Fehlerumschlag.

StatusBedeutungAktion
400Ungültige AnfrageÜberprüfen Sie den Anfragetext und die Modell-ID.
401Ungültiger oder eingefrorener SchlüsselÜberprüfen oder rotieren Sie den API-Schlüssel.
429Raten- oder Parallelitätslimit überschrittenRespektieren Retry-After und versuchen Sie es erneut mit Backoff.
5xxVorübergehender Upstream- oder Gateway-FehlerWiederholen Sie idempotente Anfragen mit exponentiellem Backoff.