B2BB2B LLM

GET /v1/models

Liste modelos habilitados, aliases, recursos e custos específicos de chave e taxas de custo de uso.

GET /v1/models

Retorna todos os modelos habilitados disponíveis para a chave de API autenticada. Os preços são sequências decimais em dólares americanos por um milhão de tokens.

Autenticação

Authorization: Bearer mg_live_...

x-api-key: mg_live_... também é aceito.

Chaves com status active ou frozen pode ler o catálogo de modelos e seus preços específicos. Uma chave congelada permanece bloqueada de pontos de extremidade de inferência e de outros pontos de extremidade de metadados de conta que exigem uma chave ativa.

Solicitar

curl https://api.model-gate.com/v1/models \
  -H "Authorization: Bearer mg_live_..."

Resposta

{
  "object": "list",
  "data": [
    {
      "id": "claude-opus-4.7",
      "object": "model",
      "owned_by": "anthropic",
      "display_name": "Claude Opus 4.7",
      "aliases": ["ch-47"],
      "currency": "USD",
      "pricing_unit": "per_1m_tokens",
      "cost": {
        "input": "0.2",
        "output": "1",
        "cache_read": "0.02",
        "cache_write": "0.25",
        "reasoning": "1"
      },
      "official_cost": {
        "input": "1",
        "output": "5",
        "cache_read": "0.1",
        "cache_write": "1.25",
        "reasoning": "5"
      },
      "usage_cost": {
        "input": "10",
        "output": "50",
        "cache_read": "1",
        "cache_write": "12.5",
        "reasoning": "50"
      },
      "usage_pricing": {
        "basis": "official_price",
        "multiplier": "10",
        "inherited_from": "key"
      },
      "batch_cost": {
        "input": "0.1",
        "output": "0.5",
        "cache_read": "0.01",
        "cache_write": "0.125",
        "reasoning": "0.5"
      },
      "batch_pricing": {
        "multiplier": "0.5",
        "applies_to": "claude_openai_compat_batches"
      },
      "context_length": 200000,
      "context_window": 200000,
      "max_input_tokens": 180000,
      "max_output_tokens": 20000,
      "max_completion_tokens": 20000,
      "supports_streaming": true,
      "supports_tools": true,
      "supports_vision": true
    }
  ]
}

Campos de preço

  • cost é a taxa real do Model Gate usada para debitar o saldo da conta.
  • official_cost é a taxa de catálogo oficial do provedor salva.
  • usage_cost é a taxa efetiva usada apenas para chaves de API redefiníveis e limites de uso de grupo.
  • usage_pricing identifica a base, o multiplicador e a fonte de herança da chave autenticada.
  • Quando o modelo de faturamento da conta tiver um coeficiente de lote diferente de 1, batch_cost mostra as taxas reais efetivas para itens de lote compatíveis com Claude/OpenAI e batch_pricing.multiplier identifica o coeficiente adicional do Model Gate. Esses campos condicionais são omitidos quando o coeficiente é 1. Nativo async=true não usa esse coeficiente.

Para official_price, cada um exibido usage_cost a taxa é official_cost × multiplier. Para user_price, isso é cost × multiplier. Estas são taxas de catálogo por milhão de tokens. A liquidação final da solicitação primeiro calcula e arredonda o valor base da solicitação selecionada para 10 casas decimais, depois aplica o multiplicador e arredonda o resultado para 10 casas decimais.

Campos de limite do modelo

  • context_window é o valor da janela de contexto voltado para o cliente e atualmente é igual context_length.
  • max_input_tokens é o valor máximo configurado do token de entrada quando conhecido.
  • max_output_tokens é o valor máximo configurado do token de saída quando conhecido.
  • max_completion_tokens é o campo de compatibilidade de limite de conclusão usado pelos metadados do modelo de estilo de provedor.
  • Um valor numérico de 0 significa que o Model Gate não possui um valor configurado para esse limite. Os clientes com substituições manuais opcionais de limite devem deixar essa configuração sem definição em vez de tratá-la. 0 como um limite real do modelo ou adivinhando outro valor.

O autenticado /models página também exibe Contexto, Entrada máxima, e Saída máxima para valores conhecidos diferentes de zero, portanto, os usuários comuns não precisam consultar a API apenas para copiar esses limites em uma configuração do cliente.

Erros

{
  "error": {
    "type": "authentication_error",
    "code": "invalid_api_key",
    "message": "missing API key"
  }
}