B2BB2B LLM

POST /v1/messages

API de messages compatible Anthropic avec alias, streaming, outils, vision, mise en cache et réflexion.

POST /v1/messages

Authentification

x-api-key: mg_live_...
anthropic-version: 2023-06-01
content-type: application/json

L'authentification du porteur est également acceptée.

Demande

curl https://api.model-gate.com/v1/messages \
  -H "x-api-key: mg_live_..." \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-4.6",
    "max_tokens": 1024,
    "messages": [
      {"role": "user", "content": "Write a short release note."}
    ]
  }'

Réponse

{
  "id": "msg_example",
  "type": "message",
  "role": "assistant",
  "model": "claude-sonnet-4.6",
  "content": [{"type": "text", "text": "This release improves documentation and model routing."}],
  "stop_reason": "end_turn",
  "usage": {
    "input_tokens": 11,
    "output_tokens": 9,
    "cache_creation_input_tokens": 0,
    "cache_read_input_tokens": 0
  }
}

Streaming

Ajouter "stream": true. Model Gate transmet les événements SSE compatibles avec Anthropic et enregistre l'utilisation finale du jeton pour le règlement.

Alias ​​et comptabilité

Si un alias est fourni, il est remplacé par le modèle canonique avant que la requête ne soit mise en file d'attente ou envoyée en amont. La tarification, le coût d'utilisation, l'historique des demandes et les restrictions de modèle utilisent le modèle canonique.

StatutSignificationAction
400Demande invalideVérifiez le corps de la demande et l'ID du modèle.
401Clé invalide ou geléeVérifiez ou faites pivoter la clé API.
429Limite de débit ou de simultanéité dépasséeRespect Retry-After et réessayez avec recul.
5xxErreur temporaire en amont ou en passerelleRéessayez les requêtes idempotentes avec une interruption exponentielle.