POST /v1/messages
Anthropic-kompatible Nachrichten-API mit Aliasen, Streaming, Tools, Vision, Caching und Denken.
POST /v1/messages
Authentifizierung
x-api-key: mg_live_...
anthropic-version: 2023-06-01
content-type: application/json
Eine Inhaberauthentifizierung wird ebenfalls akzeptiert.
Anfrage
curl https://api.model-gate.com/v1/messages \
-H "x-api-key: mg_live_..." \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-4.6",
"max_tokens": 1024,
"messages": [
{"role": "user", "content": "Write a short release note."}
]
}'
Antwort
{
"id": "msg_example",
"type": "message",
"role": "assistant",
"model": "claude-sonnet-4.6",
"content": [{"type": "text", "text": "This release improves documentation and model routing."}],
"stop_reason": "end_turn",
"usage": {
"input_tokens": 11,
"output_tokens": 9,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0
}
}
Streaming
Hinzufügen "stream": true. Model Gate leitet Anthropic-kompatible SSE-Ereignisse weiter und zeichnet die endgültige Token-Nutzung zur Abrechnung auf.
Aliase und Buchhaltung
Wenn ein Alias angegeben wird, wird dieser durch das kanonische Modell ersetzt, bevor die Anforderung in die Warteschlange gestellt oder an den Upstream gesendet wird. Für Preise, Nutzungskosten, Anfrageverlauf und Modelleinschränkungen wird das kanonische Modell verwendet.
| Status | Bedeutung | Aktion |
|---|---|---|
400 | Ungültige Anfrage | Überprüfen Sie den Anfragetext und die Modell-ID. |
401 | Ungültiger oder eingefrorener Schlüssel | Überprüfen oder rotieren Sie den API-Schlüssel. |
429 | Raten- oder Parallelitätslimit überschritten | Respektieren Retry-After und versuchen Sie es erneut mit Backoff. |
5xx | Vorübergehender Upstream- oder Gateway-Fehler | Wiederholen Sie idempotente Anfragen mit exponentiellem Backoff. |