B2BB2B LLM

POST /v1/chat/completions

Дополнения чата, совместимые с OpenAI, с потоковой передачей, инструментами, видением и псевдонимами моделей.

POST /v1/chat/completions

Запрос

curl https://api.model-gate.com/v1/chat/completions \
  -H "Authorization: Bearer mg_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "ch-47",
    "messages": [
      {"role": "user", "content": "Explain this API in one sentence."}
    ],
    "stream": false
  }'

The model может быть каноническим идентификатором или включенным псевдонимом. Model Gate разрешает псевдонимы до определения цены и отправляет канонический идентификатор вверх по течению.

Ответ

{
  "id": "chatcmpl_example",
  "object": "chat.completion",
  "model": "claude-opus-4.7",
  "choices": [
    {
      "index": 0,
      "message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 14,
    "completion_tokens": 17,
    "total_tokens": 31
  }
}

Запрос потоковой передачи

Набор "stream": true. Восходящие события, отправленные сервером, передаются без перезаписи полезных данных успешных событий.

Асинхронный запрос

Для поддерживаемых конечных точек добавьте "async": true с "stream": false. Немедленный ответ — HTTP 202 и содержит request_id и URL-адрес результата Partner API.

Ошибки

Статус, текст и тип контента поставщика, отличные от 2xx, передаются без изменений. Локально сгенерированные ошибки проверки используют конверт ошибок Model Gate.

СтатусЗначениеДействие
400Неверный запросПроверьте тело запроса и идентификатор модели.
401Неверный или замороженный ключПроверьте или поменяйте ключ API.
429Превышен лимит скорости или параллелизмаУважать Retry-After и повторите попытку с отсрочкой.
5xxВременная ошибка восходящего потока или шлюзаПовторите идемпотентные запросы с экспоненциальной задержкой.