POST /v1/chat/completions
Дополнения чата, совместимые с OpenAI, с потоковой передачей, инструментами, видением и псевдонимами моделей.
POST /v1/chat/completions
Запрос
curl https://api.model-gate.com/v1/chat/completions \
-H "Authorization: Bearer mg_live_..." \
-H "Content-Type: application/json" \
-d '{
"model": "ch-47",
"messages": [
{"role": "user", "content": "Explain this API in one sentence."}
],
"stream": false
}'
The model может быть каноническим идентификатором или включенным псевдонимом. Model Gate разрешает псевдонимы до определения цены и отправляет канонический идентификатор вверх по течению.
Ответ
{
"id": "chatcmpl_example",
"object": "chat.completion",
"model": "claude-opus-4.7",
"choices": [
{
"index": 0,
"message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 14,
"completion_tokens": 17,
"total_tokens": 31
}
}
Запрос потоковой передачи
Набор "stream": true. Восходящие события, отправленные сервером, передаются без перезаписи полезных данных успешных событий.
Асинхронный запрос
Для поддерживаемых конечных точек добавьте "async": true с "stream": false. Немедленный ответ — HTTP 202 и содержит request_id и URL-адрес результата Partner API.
Ошибки
Статус, текст и тип контента поставщика, отличные от 2xx, передаются без изменений. Локально сгенерированные ошибки проверки используют конверт ошибок Model Gate.
| Статус | Значение | Действие |
|---|---|---|
400 | Неверный запрос | Проверьте тело запроса и идентификатор модели. |
401 | Неверный или замороженный ключ | Проверьте или поменяйте ключ API. |
429 | Превышен лимит скорости или параллелизма | Уважать Retry-After и повторите попытку с отсрочкой. |
5xx | Временная ошибка восходящего потока или шлюза | Повторите идемпотентные запросы с экспоненциальной задержкой. |