POST /v1/chat/completions
ストリーミング、ツール、ビジョン、モデルのエイリアスを使用した OpenAI 互換のチャット補完。
POST /v1/chat/completions
リクエスト
curl https://api.model-gate.com/v1/chat/completions \
-H "Authorization: Bearer mg_live_..." \
-H "Content-Type: application/json" \
-d '{
"model": "ch-47",
"messages": [
{"role": "user", "content": "Explain this API in one sentence."}
],
"stream": false
}'
の model 正規 ID または有効なエイリアスを指定できます。 Model Gate は、価格設定の前にエイリアスを解決し、正規 ID を上流に送信します。
応答
{
"id": "chatcmpl_example",
"object": "chat.completion",
"model": "claude-opus-4.7",
"choices": [
{
"index": 0,
"message": {"role": "assistant", "content": "Model Gate provides one compatible API for multiple AI models."},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 14,
"completion_tokens": 17,
"total_tokens": 31
}
}
ストリーミングリクエスト
セット "stream": true。上流のサーバー送信イベントは、成功したイベント ペイロードを書き換えることなくパススルーされます。
非同期リクエスト
サポートされているエンドポイントについては、追加します "async": true と "stream": false。即時の応答は HTTP です 202 そして含まれています request_id および Partner API の結果 URL。
エラー
プロバイダーの非 2xx ステータス、本文、コンテンツ タイプは変更されずに渡されます。ローカルで生成された検証エラーは、Model Gate エラー エンベロープを使用します。
| 状態 | 意味 | アクション |
|---|---|---|
400 | 無効なリクエスト | リクエストボディとモデルIDを確認してください。 |
401 | 無効または凍結されたキー | API キーを確認またはローテーションします。 |
429 | レートまたは同時実行の制限を超えました | 尊敬 Retry-After バックオフで再試行してください。 |
5xx | 一時的なアップストリームまたはゲートウェイのエラー | 指数バックオフを使用して冪等リクエストを再試行します。 |