B2BB2B LLM

POST /v1/chat/completions

Uzupełnianie czatów zgodne z OpenAI za pomocą przesyłania strumieniowego, narzędzi, wizji i aliasów modeli.

POST /v1/chat/completions

Wniosek

curl https://api.model-gate.com/v1/chat/completions \
  -H "Authorization: Bearer mg_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "ch-47",
    "messages": [
      {"role": "user", "content": "Explain this API in one sentence."}
    ],
    "stream": false
  }'

The model może być identyfikatorem kanonicznym lub włączonym aliasem. Model Gate rozpoznaje aliasy przed wyceną i wysyła kanoniczny identyfikator w górę strumienia.

Odpowiedź

{
  "id": "chatcmpl_example",
  "object": "chat.completion",
  "model": "claude-opus-4.7",
  "choices": [
    {
      "index": 0,
      "message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 14,
    "completion_tokens": 17,
    "total_tokens": 31
  }
}

Prośba o transmisję strumieniową

Ustawić "stream": true. Zdarzenia wysłane przez serwer nadrzędne są przekazywane bez przepisywania pomyślnych ładunków zdarzeń.

Żądanie asynchroniczne

W przypadku obsługiwanych punktów końcowych dodaj "async": true z "stream": false. Natychmiastową odpowiedzią jest HTTP 202 i zawiera request_id i wynikowy adres URL Partner API.

Błędy

Stan, treść i typ zawartości dostawcy innego niż 2xx są przekazywane bez zmian. Lokalnie generowane błędy sprawdzania poprawności korzystają z obwiedni błędów bramki modelu.

StatusOznaczającyDziałanie
400Nieprawidłowe żądanieSprawdź treść żądania i identyfikator modelu.
401Nieprawidłowy lub zamrożony kluczZweryfikuj lub obróć klucz API.
429Przekroczono limit szybkości lub współbieżnościSzacunek Retry-After i spróbuj ponownie z wycofaniem.
5xxTymczasowy błąd upstream lub bramyPonów żądanie idempotentne z wykładniczym wycofywaniem.