B2BB2B LLM

Partner API Często zadawane pytania

Praktyczne odpowiedzi na temat kluczy do kont, użycia, rotacji i wywołań zwrotnych.

Partner API Często zadawane pytania

Jaka jest różnica między kluczem API konta a kluczem API modelu?

Klucz API na poziomie konta (mg_partner_...) zarządza kluczami API modelu poprzez https://p-api.model-gate.com/api/v1/partner/* i pobiera asynchroniczne wyniki poprzez https://p-api.model-gate.com/api/v1/requests/{request_public_id}.

Klucz API modelu (mg_live_...) uwierzytelnia żądania wnioskowania poprzez https://api.model-gate.com.

Nigdy nie wysyłaj klucza Partner API na poziomie konta do punktu końcowego wnioskowania ani nie ujawniaj go w aplikacjach po stronie klienta.

Który licznik wymusza spend_limit?

Możliwość resetowania usage licznik wymusza limit. POST /api/v1/partner/keys/{key_public_id}/reset-usage czyści licznik kluczy. total_spent jest rozliczaniem przez całe życie i nigdy się nie resetuje.

Czy każdy klucz Model API ma osobne saldo konta?

Nie. Wszystkie klucze Model API są wydawane z salda konta Model Gate. Limity dla poszczególnych kluczy i grup ograniczają użycie bez dzielenia salda konta na salda podrzędne.

Co się stanie, gdy klucz API modelu zostanie obrócony?

Stary sekret natychmiast przestaje działać. Odpowiedź na rotację zawiera raz nowy klucz tajny w postaci zwykłego tekstu. Przechowuj go bezpiecznie, ponieważ Model Gate nie wyświetli ponownie całego sekretu.

Jak skonfigurowane są wywołania zwrotne?

Skonfiguruj callback_url i obracaj callback_secret w profilu Model Gate. Wyniki zakończenia asynchronicznego są wysyłane, gdy istnieje adres URL wywołania zwrotnego. Opcjonalne zdarzenia niskiego limitu, limitu grupy kluczy i niskiego salda konta można włączyć osobno; ich progi są konfigurowane w powiadomieniach profilu.

Dostarczanie wywołań zwrotnych jest trwałe i niezależne od przetwarzania wnioskowań. Każde wydarzenie niesie ze sobą stajnię event_id która pozostaje niezmieniona przy kolejnych próbach i musi być używana do deduplikacji konsumenckiej. Dowolny HTTP 2xx odpowiedź zakończyła się sukcesem. Dostarczenie obejmuje łącznie maksymalnie 6 prób, z ponownymi próbami po 5 sekundach, 30 sekundach, 2 minutach, 10 minutach i 1 godzinie; przy każdej próbie obowiązuje całkowity limit czasu wynoszący 15 sekund. Błędy transportu, przekroczenia limitu czasu i odpowiedzi inne niż 2xx są ponawiane, a po szóstej nieudanej próbie zdarzenie jest zaznaczane failed bez dalszych automatycznych prób. Widzieć Oddzwonienia w przypadku katalogu wydarzeń, ładunków w formacie dokładnie dziesiętnym, podpisów, bezpieczeństwa miejsca docelowego i szczegółów dostawy.

Jak długo można pobierać wynik asynchroniczny?

Wynik asynchroniczny pozostaje dostępny przez 24 godziny GET https://p-api.model-gate.com/api/v1/requests/{request_public_id}. Po wygaśnięciu zapisane żądanie i odpowiedź są usuwane, a punkt końcowy powraca 404.

Czy mutacje partnerów umożliwiają bezpieczną ponowną próbę?

Tak. Co Partner API POST, PATCH, I DELETE wymaga Idempotency-Key. Ponów próbę wykonania tej samej operacji logicznej z tym samym kluczem po upływie limitu czasu; przez 7 dni Model Gate zwraca oryginalny wynik bez ponownego wykonywania mutacji. Ponowne użycie klucza dla innego żądania powoduje powrót 409.

Jak długo dostępna jest szczegółowa historia żądań?

Poniżej znajduje się szczegółowa historia żądań partnerów API_REQUESTS_HOT_RETENTION_DAYS (domyślnie 7 dni) i raportuje to okno w metadanych odpowiedzi. Do długoterminowych rozliczeń finansowych używaj transakcji salda konta z podziałem na strony kursora.