B2BB2B LLM

GET /v1/models

Enumere los modelos habilitados, los alias, las capacidades y las tasas de costos y costos de uso específicos de claves.

GET /v1/models

Devuelve todos los modelos habilitados disponibles para la clave API autenticada. Los precios son cadenas decimales en USD por millón de tokens.

Autenticación

Authorization: Bearer mg_live_...

x-api-key: mg_live_... También se acepta.

Claves con estado active o frozen Puede leer el catálogo de modelos y sus precios específicos clave. Una clave congelada permanece bloqueada desde los puntos finales de inferencia y desde otros puntos finales de metadatos de la cuenta que requieren una clave activa.

Pedido

curl https://api.model-gate.com/v1/models \
  -H "Authorization: Bearer mg_live_..."

Respuesta

{
  "object": "list",
  "data": [
    {
      "id": "claude-opus-4.7",
      "object": "model",
      "owned_by": "anthropic",
      "display_name": "Claude Opus 4.7",
      "aliases": ["ch-47"],
      "currency": "USD",
      "pricing_unit": "per_1m_tokens",
      "cost": {
        "input": "0.2",
        "output": "1",
        "cache_read": "0.02",
        "cache_write": "0.25",
        "reasoning": "1"
      },
      "official_cost": {
        "input": "1",
        "output": "5",
        "cache_read": "0.1",
        "cache_write": "1.25",
        "reasoning": "5"
      },
      "usage_cost": {
        "input": "10",
        "output": "50",
        "cache_read": "1",
        "cache_write": "12.5",
        "reasoning": "50"
      },
      "usage_pricing": {
        "basis": "official_price",
        "multiplier": "10",
        "inherited_from": "key"
      },
      "batch_cost": {
        "input": "0.1",
        "output": "0.5",
        "cache_read": "0.01",
        "cache_write": "0.125",
        "reasoning": "0.5"
      },
      "batch_pricing": {
        "multiplier": "0.5",
        "applies_to": "claude_openai_compat_batches"
      },
      "context_length": 200000,
      "context_window": 200000,
      "max_input_tokens": 180000,
      "max_output_tokens": 20000,
      "max_completion_tokens": 20000,
      "supports_streaming": true,
      "supports_tools": true,
      "supports_vision": true
    }
  ]
}

Campos de precio

  • cost es la tasa real de Model Gate utilizada para debitar el saldo de la cuenta.
  • official_cost es la tarifa guardada del catálogo oficial de proveedores.
  • usage_cost es la tasa efectiva que se utiliza solo para los límites de uso de grupos y claves API reiniciables.
  • usage_pricing identifica la base, el multiplicador y la fuente de herencia de la clave autenticada.
  • Cuando la plantilla de facturación de la cuenta tiene un coeficiente de lote diferente al 1, batch_cost muestra las tasas reales efectivas para artículos por lotes compatibles con Claude/OpenAI y batch_pricing.multiplier identifica el coeficiente adicional de Model Gate. Estos campos condicionales se omiten cuando el coeficiente es 1. Nativo async=true no utiliza este coeficiente.

Para official_price, cada uno mostrado usage_cost la tasa es official_cost × multiplier. Para user_price, es cost × multiplier. Estas son tarifas de catálogo por millón de tokens. La liquidación de solicitud final primero calcula y redondea el monto de la solicitud base seleccionada a 10 decimales, luego aplica el multiplicador y redondea el resultado a 10 decimales.

Campos de límite del modelo

  • context_window es el valor de la ventana contextual orientada al cliente y actualmente es igual context_length.
  • max_input_tokens es el valor máximo configurado del token de entrada cuando se conoce.
  • max_output_tokens es el valor máximo configurado del token de salida cuando se conoce.
  • max_completion_tokens es el campo de compatibilidad de límite de finalización utilizado por los metadatos del modelo de estilo de proveedor.
  • Un valor numérico de 0 significa que Model Gate no tiene un valor configurado para ese límite. Los clientes con anulaciones de límites manuales opcionales deben dejar esa configuración sin configurar en lugar de tratar 0 como límite del modelo real o adivinando otro valor.

El autenticado /models La página también muestra Contexto, Entrada máxima, y Salida máxima para valores conocidos distintos de cero, por lo que los usuarios normales no necesitan consultar la API solo para copiar estos límites en la configuración de un cliente.

Errores

{
  "error": {
    "type": "authentication_error",
    "code": "invalid_api_key",
    "message": "missing API key"
  }
}