B2BB2B LLM

POST /v1/chat/completions

ストリーミング、ツール、ビジョン、モデルのエイリアスを使用した OpenAI 互換のチャット補完。

POST /v1/chat/completions

リクエスト

curl https://api.model-gate.com/v1/chat/completions \
  -H "Authorization: Bearer mg_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "ch-47",
    "messages": [
      {"role": "user", "content": "Explain this API in one sentence."}
    ],
    "stream": false
  }'

model 正規 ID または有効なエイリアスを指定できます。 Model Gate は、価格設定の前にエイリアスを解決し、正規 ID を上流に送信します。

応答

{
  "id": "chatcmpl_example",
  "object": "chat.completion",
  "model": "claude-opus-4.7",
  "choices": [
    {
      "index": 0,
      "message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 14,
    "completion_tokens": 17,
    "total_tokens": 31
  }
}

ストリーミングリクエスト

セット "stream": true。上流のサーバー送信イベントは、成功したイベント ペイロードを書き換えることなくパススルーされます。

非同期リクエスト

サポートされているエンドポイントについては、追加します "async": true"stream": false。即時の応答は HTTP です 202 そして含まれています request_id および Partner API の結果 URL。

エラー

プロバイダーの非 2xx ステータス、本文、コンテンツ タイプは変更されずに渡されます。ローカルで生成された検証エラーは、Model Gate エラー エンベロープを使用します。

状態意味アクション
400無効なリクエストリクエストボディとモデルIDを確認してください。
401無効または凍結されたキーAPI キーを確認またはローテーションします。
429レートまたは同時実行の制限を超えました尊敬 Retry-After バックオフで再試行してください。
5xx一時的なアップストリームまたはゲートウェイのエラー指数バックオフを使用して冪等リクエストを再試行します。