POST /v1/chat/completions
Uzupełnianie czatów zgodne z OpenAI za pomocą przesyłania strumieniowego, narzędzi, wizji i aliasów modeli.
POST /v1/chat/completions
Wniosek
curl https://api.model-gate.com/v1/chat/completions \
-H "Authorization: Bearer mg_live_..." \
-H "Content-Type: application/json" \
-d '{
"model": "ch-47",
"messages": [
{"role": "user", "content": "Explain this API in one sentence."}
],
"stream": false
}'
The model może być identyfikatorem kanonicznym lub włączonym aliasem. Model Gate rozpoznaje aliasy przed wyceną i wysyła kanoniczny identyfikator w górę strumienia.
Odpowiedź
{
"id": "chatcmpl_example",
"object": "chat.completion",
"model": "claude-opus-4.7",
"choices": [
{
"index": 0,
"message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 14,
"completion_tokens": 17,
"total_tokens": 31
}
}
Prośba o transmisję strumieniową
Ustawić "stream": true. Zdarzenia wysłane przez serwer nadrzędne są przekazywane bez przepisywania pomyślnych ładunków zdarzeń.
Żądanie asynchroniczne
W przypadku obsługiwanych punktów końcowych dodaj "async": true z "stream": false. Natychmiastową odpowiedzią jest HTTP 202 i zawiera request_id i wynikowy adres URL Partner API.
Błędy
Stan, treść i typ zawartości dostawcy innego niż 2xx są przekazywane bez zmian. Lokalnie generowane błędy sprawdzania poprawności korzystają z obwiedni błędów bramki modelu.
| Status | Oznaczający | Działanie |
|---|---|---|
400 | Nieprawidłowe żądanie | Sprawdź treść żądania i identyfikator modelu. |
401 | Nieprawidłowy lub zamrożony klucz | Zweryfikuj lub obróć klucz API. |
429 | Przekroczono limit szybkości lub współbieżności | Szacunek Retry-After i spróbuj ponownie z wycofaniem. |
5xx | Tymczasowy błąd upstream lub bramy | Ponów żądanie idempotentne z wykładniczym wycofywaniem. |