B2BB2B LLM

GET /v1/models

Listen Sie aktivierte Modelle, Aliase, Funktionen sowie schlüsselspezifische Kosten- und Nutzungskostensätze auf.

GET /v1/models

Gibt jedes aktivierte Modell zurück, das für den authentifizierten API-Schlüssel verfügbar ist. Die Preise sind Dezimalzeichenfolgen in USD pro einer Million Token.

Authentifizierung

Authorization: Bearer mg_live_...

x-api-key: mg_live_... wird auch akzeptiert.

Schlüssel mit Status active oder frozen können den Modellkatalog und deren schlüsselspezifische Preise einsehen. Ein eingefrorener Schlüssel bleibt für Inferenzendpunkte und andere Kontometadatenendpunkte blockiert, die einen aktiven Schlüssel erfordern.

Anfrage

curl https://api.model-gate.com/v1/models \
  -H "Authorization: Bearer mg_live_..."

Antwort

{
  "object": "list",
  "data": [
    {
      "id": "claude-opus-4.7",
      "object": "model",
      "owned_by": "anthropic",
      "display_name": "Claude Opus 4.7",
      "aliases": ["ch-47"],
      "currency": "USD",
      "pricing_unit": "per_1m_tokens",
      "cost": {
        "input": "0.2",
        "output": "1",
        "cache_read": "0.02",
        "cache_write": "0.25",
        "reasoning": "1"
      },
      "official_cost": {
        "input": "1",
        "output": "5",
        "cache_read": "0.1",
        "cache_write": "1.25",
        "reasoning": "5"
      },
      "usage_cost": {
        "input": "10",
        "output": "50",
        "cache_read": "1",
        "cache_write": "12.5",
        "reasoning": "50"
      },
      "usage_pricing": {
        "basis": "official_price",
        "multiplier": "10",
        "inherited_from": "key"
      },
      "batch_cost": {
        "input": "0.1",
        "output": "0.5",
        "cache_read": "0.01",
        "cache_write": "0.125",
        "reasoning": "0.5"
      },
      "batch_pricing": {
        "multiplier": "0.5",
        "applies_to": "claude_openai_compat_batches"
      },
      "context_length": 200000,
      "context_window": 200000,
      "max_input_tokens": 180000,
      "max_output_tokens": 20000,
      "max_completion_tokens": 20000,
      "supports_streaming": true,
      "supports_tools": true,
      "supports_vision": true
    }
  ]
}

Preisfelder

  • cost ist der tatsächliche Model Gate-Kurs, der zur Belastung des Kontostands verwendet wird.
  • official_cost ist der hinterlegte offizielle Anbieterkatalogtarif.
  • usage_cost ist die effektive Rate, die nur für zurücksetzbare API-Schlüssel- und Gruppennutzungslimits verwendet wird.
  • usage_pricing identifiziert die Basis, den Multiplikator und die Vererbungsquelle für den authentifizierten Schlüssel.
  • Wenn die Kontoabrechnungsvorlage einen anderen Batch-Koeffizienten aufweist als 1, batch_cost zeigt die effektiven Ist-Raten für Claude/OpenAI-kompatible Batch-Artikel und an batch_pricing.multiplier identifiziert den zusätzlichen Model-Gate-Koeffizienten. Diese Bedingungsfelder werden weggelassen, wenn der Koeffizient ist 1. Einheimisch async=true verwendet diesen Koeffizienten nicht.

Für official_price, jeweils angezeigt usage_cost Rate ist official_cost × multiplier. Für user_price, es ist cost × multiplier. Hierbei handelt es sich um Katalogpreise pro Million Token. Bei der endgültigen Anforderungsabrechnung wird zunächst der ausgewählte Basisanforderungsbetrag berechnet und auf 10 Dezimalstellen gerundet. Anschließend wird der Multiplikator angewendet und das Ergebnis auf 10 Dezimalstellen gerundet.

Modellgrenzfelder

  • context_window ist der clientseitige Kontextfensterwert und ist derzeit gleich context_length.
  • max_input_tokens ist der konfigurierte maximale Eingabe-Token-Wert, sofern bekannt.
  • max_output_tokens ist der konfigurierte maximale Ausgabe-Token-Wert, sofern bekannt.
  • max_completion_tokens ist das Vervollständigungslimit-Kompatibilitätsfeld, das von Modellmetadaten im Anbieterstil verwendet wird.
  • Ein numerischer Wert von 0 bedeutet, dass Model Gate keinen konfigurierten Wert für diesen Grenzwert hat. Clients mit optionalen manuellen Grenzwertüberschreibungen sollten diese Einstellung deaktiviert lassen, anstatt sie zu behandeln 0 als tatsächliche Modellgrenze oder als Schätzung eines anderen Werts.

Die authentifizierte /models Seite wird ebenfalls angezeigt Kontext, Maximaler Eingang, Und Maximale Leistung für bekannte Werte ungleich Null, sodass normale Benutzer nicht die API abfragen müssen, nur um diese Grenzwerte in eine Client-Konfiguration zu kopieren.

Fehler

{
  "error": {
    "type": "authentication_error",
    "code": "invalid_api_key",
    "message": "missing API key"
  }
}