B2BB2B LLM

Partner APIFAQ

Des réponses pratiques sur les clés de compte, leur utilisation, leur rotation et leurs rappels.

Partner APIFAQ

Quelle est la différence entre une clé API de compte et une clé API de modèle ?

La clé API au niveau du compte (mg_partner_...) gère les clés API du modèle via https://p-api.model-gate.com/api/v1/partner/* et récupère les résultats asynchrones via https://p-api.model-gate.com/api/v1/requests/{request_public_id}.

Une clé API de modèle (mg_live_...) authentifie les demandes d'inférence via https://api.model-gate.com.

N'envoyez jamais de clé Partner API au niveau du compte à un point de terminaison d'inférence et ne l'exposez jamais dans des applications côté client.

Quel compteur applique spend_limit?

Le réinitialisable usage le compteur applique la limite. POST /api/v1/partner/keys/{key_public_id}/reset-usage efface le compteur de clés. total_spent est une comptabilité à vie et ne se réinitialise jamais.

Chaque clé API de modèle a-t-elle un solde de compte distinct ?

Non. Toutes les clés API Model sont dépensées à partir du solde du compte Model Gate propriétaire. Les limites par clé et par groupe limitent l'utilisation sans diviser le solde du compte en soldes enfants.

Que se passe-t-il lors d'une rotation d'une clé API de modèle ?

Le vieux secret cesse immédiatement de fonctionner. La réponse de rotation contient une fois le nouveau secret en texte brut. Conservez-le en toute sécurité car Model Gate n'affiche plus le secret complet.

Comment sont configurés les rappels ?

Configurer callback_url et faire pivoter callback_secret dans le profil Model Gate. Les résultats d'achèvement asynchrone sont envoyés lorsqu'une URL de rappel existe. Les événements facultatifs de limite basse, de limite de groupe de clés et de solde de compte faible peuvent être activés séparément ; leurs seuils sont configurés dans les notifications de profil.

La livraison de rappel est durable et indépendante du traitement d’inférence. Chaque événement porte une écurie event_id qui reste inchangé au fil des tentatives et doit être utilisé pour la déduplication du consommateur. N'importe quel HTTP 2xx la réponse est réussie. La livraison utilise au maximum 6 tentatives au total, avec des tentatives après 5 secondes, 30 secondes, 2 minutes, 10 minutes et 1 heure ; chaque tentative a un délai d'attente global de 15 secondes. Les erreurs de transport, les délais d'attente et les réponses non-2xx sont réessayés, et après la sixième tentative infructueuse, l'événement est marqué failed sans autre tentative automatique. Voir Rappels pour le catalogue d'événements, les charges utiles en décimales exactes, les signatures, la sécurité de la destination et les détails de livraison.

Combien de temps un résultat asynchrone peut-il être récupéré ?

Un résultat asynchrone reste disponible pendant 24 heures via GET https://p-api.model-gate.com/api/v1/requests/{request_public_id}. Après l'expiration, la demande et la réponse stockées sont supprimées et le point de terminaison renvoie 404.

Les mutations partenaires permettent-elles une nouvelle tentative sécurisée ?

Oui. Tous les Partner API POST, PATCH, et DELETE nécessite Idempotency-Key. Réessayez la même opération logique avec la même clé après un délai d'attente ; pendant 7 jours, Model Gate renvoie le résultat original sans réexécuter la mutation. La réutilisation d'une clé pour une requête différente renvoie 409.

Pendant combien de temps l’historique détaillé des demandes est-il disponible ?

L'historique détaillé des demandes de partenaires suit API_REQUESTS_HOT_RETENTION_DAYS (7 jours par défaut) et signale cette fenêtre dans les métadonnées de réponse. Utilisez les transactions de solde de compte paginées par curseur pour un rapprochement financier à plus long terme.