B2BB2B LLM

POST /v1/messages

Anthropic-kompatible Nachrichten-API mit Aliasen, Streaming, Tools, Vision, Caching und Denken.

POST /v1/messages

Authentifizierung

x-api-key: mg_live_...
anthropic-version: 2023-06-01
content-type: application/json

Eine Inhaberauthentifizierung wird ebenfalls akzeptiert.

Anfrage

curl https://api.model-gate.com/v1/messages \
  -H "x-api-key: mg_live_..." \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-4.6",
    "max_tokens": 1024,
    "messages": [
      {"role": "user", "content": "Write a short release note."}
    ]
  }'

Antwort

{
  "id": "msg_example",
  "type": "message",
  "role": "assistant",
  "model": "claude-sonnet-4.6",
  "content": [{"type": "text", "text": "This release improves documentation and model routing."}],
  "stop_reason": "end_turn",
  "usage": {
    "input_tokens": 11,
    "output_tokens": 9,
    "cache_creation_input_tokens": 0,
    "cache_read_input_tokens": 0
  }
}

Streaming

Hinzufügen "stream": true. Model Gate leitet Anthropic-kompatible SSE-Ereignisse weiter und zeichnet die endgültige Token-Nutzung zur Abrechnung auf.

Aliase und Buchhaltung

Wenn ein Alias ​​angegeben wird, wird dieser durch das kanonische Modell ersetzt, bevor die Anforderung in die Warteschlange gestellt oder an den Upstream gesendet wird. Für Preise, Nutzungskosten, Anfrageverlauf und Modelleinschränkungen wird das kanonische Modell verwendet.

StatusBedeutungAktion
400Ungültige AnfrageÜberprüfen Sie den Anfragetext und die Modell-ID.
401Ungültiger oder eingefrorener SchlüsselÜberprüfen oder rotieren Sie den API-Schlüssel.
429Raten- oder Parallelitätslimit überschrittenRespektieren Retry-After und versuchen Sie es erneut mit Backoff.
5xxVorübergehender Upstream- oder Gateway-FehlerWiederholen Sie idempotente Anfragen mit exponentiellem Backoff.