B2BB2B LLM

Partner API Întrebări frecvente

Răspunsuri practice despre cheile de cont, utilizare, rotație și apeluri inverse.

Partner API Întrebări frecvente

Care este diferența dintre o cheie API de cont și o cheie API Model?

Cheia API la nivel de cont (mg_partner_...) gestionează cheile Model API prin https://p-api.model-gate.com/api/v1/partner/* și preia rezultate asincrone prin https://p-api.model-gate.com/api/v1/requests/{request_public_id}.

O cheie API Model (mg_live_...) autentifică cererile de inferență prin https://api.model-gate.com.

Nu trimiteți niciodată o cheie Partner API la nivel de cont la un punct final de inferență și nu o expuneți în aplicații de la partea clientului.

Care contor impune spend_limit?

Resetabilul usage counter impune limita. POST /api/v1/partner/keys/{key_public_id}/reset-usage șterge contorul cheilor. total_spent este o contabilitate pe viață și nu se resetează niciodată.

Fiecare cheie Model API are un sold separat de cont?

Nu. Toate cheile Model API cheltuiesc din soldul contului care deține Model Gate. Limitele pe cheie și pe grup restricționează utilizarea fără a împărți soldul contului în solduri secundare.

Ce se întâmplă când o cheie Model API este rotită?

Vechiul secret nu mai funcționează imediat. Răspunsul de rotație conține o singură dată noul secret de text simplu. Păstrați-l în siguranță, deoarece Model Gate nu afișează din nou secretul complet.

Cum sunt configurate apelurile inverse?

Configurați callback_url și rotiți callback_secret în profilul Model Gate. Rezultatele finalizării asincrone sunt trimise atunci când există o adresă URL de apel invers. Limita minimă opțională, limita grupului de chei și evenimentele cu soldul scăzut al contului pot fi activate separat; pragurile acestora sunt configurate în notificările de profil.

Livrarea apelului invers este durabilă și independentă de procesarea inferenței. Fiecare eveniment poartă un grajd event_id care rămâne neschimbat între încercări și trebuie utilizat pentru deduplicarea consumatorilor. Orice HTTP 2xx răspunsul este de succes. Livrarea utilizează cel mult 6 încercări în total, cu reîncercări după 5 secunde, 30 de secunde, 2 minute, 10 minute și 1 oră; fiecare încercare are un timeout total de 15 secunde. Erorile de transport, timeout-urile și răspunsurile non-2xx sunt reîncercate, iar după a șasea încercare eșuată, evenimentul este marcat failed fără o altă încercare automată. Vedea Reapeluri pentru catalogul de evenimente, încărcături utile în zecimală exactă, semnături, securitatea destinației și detaliile de livrare.

Cât timp poate fi preluat un rezultat asincron?

Un rezultat asincron rămâne disponibil timp de 24 de ore GET https://p-api.model-gate.com/api/v1/requests/{request_public_id}. După expirare, cererea și răspunsul stocate sunt șterse și punctul final revine 404.

Mutațiile partenerului acceptă reîncercarea sigură?

Da. La fiecare Partner API POST, PATCH, și DELETE cere Idempotency-Key. Reîncercați aceeași operațiune logică cu aceeași cheie după un timeout; timp de 7 zile Model Gate returnează rezultatul original fără a executa din nou mutația. Reutilizarea unei chei pentru o cerere diferită revine 409.

Cât timp este disponibil istoricul detaliat al solicitărilor?

Urmează istoricul detaliat al solicitărilor de parteneri API_REQUESTS_HOT_RETENTION_DAYS (implicit 7 zile) și raportează acea fereastră în metadatele răspunsului. Utilizați tranzacțiile soldului contului paginate cu cursorul pentru reconcilierea financiară pe termen lung.