Partner API preguntas frecuentes
Respuestas prácticas sobre claves de cuenta, uso, rotación y devoluciones de llamadas.
Partner API preguntas frecuentes
¿Cuál es la diferencia entre una clave API de cuenta y una clave API modelo?
La clave API a nivel de cuenta (mg_partner_...) gestiona las claves de API del modelo a través de https://p-api.model-gate.com/api/v1/partner/* y recupera resultados asincrónicos a través de https://p-api.model-gate.com/api/v1/requests/{request_public_id}.
Una clave API de modelo (mg_live_...) autentica solicitudes de inferencia a través de https://api.model-gate.com.
Nunca envíe una clave Partner API de nivel de cuenta a un punto final de inferencia ni la exponga en aplicaciones del lado cliente.
¿Qué contraataque impone? spend_limit?
El reiniciable usage El contador impone el límite. POST /api/v1/partner/keys/{key_public_id}/reset-usage borra el contador de llaves. total_spent es contabilidad de por vida y nunca se reinicia.
¿Cada clave de API modelo tiene un saldo de cuenta independiente?
No. Todas las claves de Model API se gastan del saldo de la cuenta propietaria de Model Gate. Los límites por clave y por grupo restringen el uso sin dividir el saldo de la cuenta en saldos secundarios.
¿Qué sucede cuando se rota una clave de API de modelo?
El viejo secreto deja de funcionar inmediatamente. La respuesta de rotación contiene el nuevo secreto de texto plano una vez. Guárdelo de forma segura porque Model Gate no vuelve a mostrar el secreto completo.
¿Cómo se configuran las devoluciones de llamada?
Configurar callback_url y rotar callback_secret en el perfil Model Gate. Los resultados de finalización asincrónica se envían cuando existe una URL de devolución de llamada. Los eventos opcionales de límite bajo, límite de grupo clave y saldo bajo de cuenta se pueden habilitar por separado; sus umbrales se configuran en Notificaciones de perfil.
La entrega de devolución de llamada es duradera e independiente del procesamiento de inferencia. Cada evento lleva un establo. event_id eso permanece sin cambios entre los reintentos y debe usarse para la deduplicación del consumidor. Cualquier HTTP 2xx la respuesta es exitosa. La entrega utiliza como máximo 6 intentos en total, con reintentos después de 5 segundos, 30 segundos, 2 minutos, 10 minutos y 1 hora; cada intento tiene un tiempo de espera total de 15 segundos. Se reintentan errores de transporte, tiempos de espera y respuestas que no son 2xx y, después del sexto intento fallido, se marca el evento. failed sin más reintentos automáticos. Ver Devoluciones de llamada para el catálogo de eventos, cargas útiles decimales exactas, firmas, seguridad del destino y detalles de entrega.
¿Cuánto tiempo se puede recuperar un resultado asíncrono?
Un resultado asincrónico permanece disponible durante 24 horas hasta GET https://p-api.model-gate.com/api/v1/requests/{request_public_id}. Después del vencimiento, la solicitud y la respuesta almacenadas se eliminan y el punto final regresa 404.
¿Las mutaciones de pareja admiten un reintento seguro?
Sí. Cada Partner API POST, PATCH, y DELETE requiere Idempotency-Key. Vuelva a intentar la misma operación lógica con la misma clave después de un tiempo de espera; durante 7 días Model Gate devuelve el resultado original sin volver a ejecutar la mutación. Reutilizar una clave para una solicitud diferente regresa 409.
¿Durante cuánto tiempo estará disponible el historial de solicitudes detallado?
A continuación se detalla el historial de solicitudes de socios API_REQUESTS_HOT_RETENTION_DAYS (7 días predeterminados) e informa esa ventana en los metadatos de respuesta. Utilice transacciones de saldo de cuenta paginadas por el cursor para una conciliación financiera a más largo plazo.