B2BB2B LLM

GET /v1/models

Elenca modelli abilitati, alias, funzionalità, costi specifici della chiave e tariffe di utilizzo.

GET /v1/models

Restituisce ogni modello abilitato disponibile per la chiave API autenticata. I prezzi sono stringhe decimali in USD per un milione di token.

Autenticazione

Authorization: Bearer mg_live_...

x-api-key: mg_live_... è anche accettato.

Chiavi con stato active O frozen può leggere il catalogo dei modelli e i prezzi specifici delle chiavi. Una chiave bloccata rimane bloccata dagli endpoint di inferenza e da altri endpoint di metadati dell'account che richiedono una chiave attiva.

Richiesta

curl https://api.model-gate.com/v1/models \
  -H "Authorization: Bearer mg_live_..."

Risposta

{
  "object": "list",
  "data": [
    {
      "id": "claude-opus-4.7",
      "object": "model",
      "owned_by": "anthropic",
      "display_name": "Claude Opus 4.7",
      "aliases": ["ch-47"],
      "currency": "USD",
      "pricing_unit": "per_1m_tokens",
      "cost": {
        "input": "0.2",
        "output": "1",
        "cache_read": "0.02",
        "cache_write": "0.25",
        "reasoning": "1"
      },
      "official_cost": {
        "input": "1",
        "output": "5",
        "cache_read": "0.1",
        "cache_write": "1.25",
        "reasoning": "5"
      },
      "usage_cost": {
        "input": "10",
        "output": "50",
        "cache_read": "1",
        "cache_write": "12.5",
        "reasoning": "50"
      },
      "usage_pricing": {
        "basis": "official_price",
        "multiplier": "10",
        "inherited_from": "key"
      },
      "batch_cost": {
        "input": "0.1",
        "output": "0.5",
        "cache_read": "0.01",
        "cache_write": "0.125",
        "reasoning": "0.5"
      },
      "batch_pricing": {
        "multiplier": "0.5",
        "applies_to": "claude_openai_compat_batches"
      },
      "context_length": 200000,
      "context_window": 200000,
      "max_input_tokens": 180000,
      "max_output_tokens": 20000,
      "max_completion_tokens": 20000,
      "supports_streaming": true,
      "supports_tools": true,
      "supports_vision": true
    }
  ]
}

Campi prezzo

  • cost è il tasso effettivo di Model Gate utilizzato per addebitare il saldo del conto.
  • official_cost è la tariffa salvata sul catalogo ufficiale del fornitore.
  • usage_cost è la tariffa effettiva utilizzata solo per i limiti di utilizzo di gruppi e chiavi API reimpostabili.
  • usage_pricing identifica la base, il moltiplicatore e la fonte di ereditarietà per la chiave autenticata.
  • Quando il modello di fatturazione dell'account ha un coefficiente batch diverso da 1, batch_cost mostra le tariffe effettive effettive per gli articoli batch compatibili con Claude/OpenAI e batch_pricing.multiplier identifica il coefficiente aggiuntivo Model Gate. Questi campi condizionali vengono omessi quando il coefficiente è 1. Nativo async=true non utilizza questo coefficiente.

Per official_price, ciascuno visualizzato usage_cost il tasso è official_cost × multiplier. Per user_price, è cost × multiplier. Queste sono le tariffe del catalogo per milione di token. La liquidazione della richiesta finale innanzitutto calcola e arrotonda l'importo della richiesta base selezionata a 10 cifre decimali, quindi applica il moltiplicatore e arrotonda il risultato a 10 cifre decimali.

Campi limite del modello

  • context_window è il valore della finestra di contesto rivolta al client e attualmente è uguale a context_length.
  • max_input_tokens è il valore massimo del token di input configurato quando noto.
  • max_output_tokens è il valore massimo del token di output configurato quando noto.
  • max_completion_tokens è il campo di compatibilità del limite di completamento utilizzato dai metadati del modello in stile provider.
  • Un valore numerico di 0 significa che Model Gate non ha un valore configurato per quel limite. I client con sostituzioni manuali facoltative dei limiti dovrebbero lasciare tale impostazione non configurata anziché intervenire 0 come limite effettivo del modello o indovinare un altro valore.

L'autenticato /models viene visualizzata anche la pagina Contesto, Ingresso massimo, E Potenza massima per valori noti diversi da zero, quindi gli utenti ordinari non hanno bisogno di interrogare l'API solo per copiare questi limiti in una configurazione client.

Errori

{
  "error": {
    "type": "authentication_error",
    "code": "invalid_api_key",
    "message": "missing API key"
  }
}