B2BB2B LLM

GET /v1/models

Wyświetl listę obsługiwanych modeli, aliasów, możliwości oraz kosztów specyficznych dla klucza i stawek kosztów użytkowania.

GET /v1/models

Zwraca każdy włączony model dostępny dla uwierzytelnionego klucza API. Ceny podane są w postaci ciągów dziesiętnych w USD za milion tokenów.

Uwierzytelnianie

Authorization: Bearer mg_live_...

x-api-key: mg_live_... jest również akceptowane.

Klucze ze statusem active Lub frozen może zapoznać się z katalogiem modeli i cenami poszczególnych kluczy. Zamrożony klucz pozostaje zablokowany w punktach końcowych wnioskowania i innych punktach końcowych metadanych konta, które wymagają aktywnego klucza.

Wniosek

curl https://api.model-gate.com/v1/models \
  -H "Authorization: Bearer mg_live_..."

Odpowiedź

{
  "object": "list",
  "data": [
    {
      "id": "claude-opus-4.7",
      "object": "model",
      "owned_by": "anthropic",
      "display_name": "Claude Opus 4.7",
      "aliases": ["ch-47"],
      "currency": "USD",
      "pricing_unit": "per_1m_tokens",
      "cost": {
        "input": "0.2",
        "output": "1",
        "cache_read": "0.02",
        "cache_write": "0.25",
        "reasoning": "1"
      },
      "official_cost": {
        "input": "1",
        "output": "5",
        "cache_read": "0.1",
        "cache_write": "1.25",
        "reasoning": "5"
      },
      "usage_cost": {
        "input": "10",
        "output": "50",
        "cache_read": "1",
        "cache_write": "12.5",
        "reasoning": "50"
      },
      "usage_pricing": {
        "basis": "official_price",
        "multiplier": "10",
        "inherited_from": "key"
      },
      "batch_cost": {
        "input": "0.1",
        "output": "0.5",
        "cache_read": "0.01",
        "cache_write": "0.125",
        "reasoning": "0.5"
      },
      "batch_pricing": {
        "multiplier": "0.5",
        "applies_to": "claude_openai_compat_batches"
      },
      "context_length": 200000,
      "context_window": 200000,
      "max_input_tokens": 180000,
      "max_output_tokens": 20000,
      "max_completion_tokens": 20000,
      "supports_streaming": true,
      "supports_tools": true,
      "supports_vision": true
    }
  ]
}

Pola cenowe

  • cost to rzeczywista stawka Model Gate zastosowana do obciążenia salda konta.
  • official_cost to zapisana oficjalna stawka katalogowa dostawcy.
  • usage_cost to efektywna stawka używana tylko w przypadku resetowalnych limitów użycia klucza API i grupy.
  • usage_pricing identyfikuje podstawę, mnożnik i źródło dziedziczenia dla uwierzytelnionego klucza.
  • Gdy szablon rozliczeń konta ma współczynnik partii inny niż 1, batch_cost pokazuje efektywne rzeczywiste stawki dla elementów wsadowych zgodnych z Claude/OpenAI oraz batch_pricing.multiplier identyfikuje dodatkowy współczynnik bramki modelu. Te pola warunkowe są pomijane, gdy współczynnik wynosi 1. Rodzinny async=true nie korzysta z tego współczynnika.

Dla official_price, każdy wyświetlany usage_cost stawka jest official_cost × multiplier. Dla user_price, to jest cost × multiplier. Są to stawki katalogowe za milion żetonów. Ostateczne rozliczenie wniosku najpierw oblicza i zaokrągla wybraną kwotę bazową żądania do 10 miejsc po przecinku, następnie stosuje mnożnik i zaokrągla wynik do 10 miejsc po przecinku.

Pola graniczne modelu

  • context_window jest wartością okna kontekstowego skierowanego do klienta i obecnie jest równa context_length.
  • max_input_tokens to skonfigurowana maksymalna wartość tokenu wejściowego, jeśli jest znana.
  • max_output_tokens to skonfigurowana maksymalna wartość tokenu wyjściowego, jeśli jest znana.
  • max_completion_tokens to pole zgodności limitu uzupełnień używane przez metadane modelu dostawcy.
  • Wartość liczbowa 0 oznacza, że ​​Model Gate nie ma skonfigurowanej wartości tego limitu. Klienci z opcjonalnym ręcznym obejściem limitów powinni pozostawić to ustawienie nieskonfigurowane, zamiast je leczyć 0 jako rzeczywisty limit modelu lub odgadnięcie innej wartości.

Uwierzytelniony /models strona również się wyświetla Kontekst, Maksymalne wejście, I Maksymalna moc wyjściowa dla znanych wartości niezerowych, więc zwykli użytkownicy nie muszą wysyłać zapytań do interfejsu API, aby skopiować te limity do konfiguracji klienta.

Błędy

{
  "error": {
    "type": "authentication_error",
    "code": "invalid_api_key",
    "message": "missing API key"
  }
}