Partner API Perguntas frequentes
Respostas práticas sobre chaves de conta, uso, rotação e retornos de chamada.
Partner API Perguntas frequentes
Qual é a diferença entre uma chave de API de conta e uma chave de API de modelo?
A chave de API no nível da conta (mg_partner_...) gerencia chaves de API do modelo por meio de https://p-api.model-gate.com/api/v1/partner/* e recupera resultados assíncronos por meio de https://p-api.model-gate.com/api/v1/requests/{request_public_id}.
Uma chave de API do modelo (mg_live_...) autentica solicitações de inferência por meio de https://api.model-gate.com.
Nunca envie uma chave Partner API no nível da conta para um endpoint de inferência nem a exponha em aplicativos do lado do cliente.
Qual contador impõe spend_limit?
O reajustável usage contador impõe o limite. POST /api/v1/partner/keys/{key_public_id}/reset-usage limpa o contador chave. total_spent é uma contabilidade vitalícia e nunca é redefinida.
Cada chave de API do modelo tem um saldo de conta separado?
Não. Todas as chaves da API do modelo são gastas com o saldo da conta do Model Gate. Os limites por chave e por grupo restringem o uso sem dividir o saldo da conta em saldos filhos.
O que acontece quando uma chave de API do modelo é alternada?
O antigo segredo para de funcionar imediatamente. A resposta de rotação contém o novo segredo de texto simples uma vez. Armazene-o com segurança porque o Model Gate não exibe o segredo completo novamente.
Como os retornos de chamada são configurados?
Configurar callback_url e girar callback_secret no perfil Model Gate. Os resultados de conclusão assíncrona são enviados quando existe um URL de retorno de chamada. Eventos opcionais de limite baixo, limite de grupo de chaves e saldo de conta baixo podem ser habilitados separadamente; seus limites são configurados nas notificações de perfil.
A entrega de retorno de chamada é durável e independente do processamento de inferência. Cada evento carrega um estábulo event_id que permanece inalterado nas novas tentativas e deve ser usado para desduplicação do consumidor. Qualquer HTTP 2xx a resposta foi bem-sucedida. A entrega utiliza no máximo 6 tentativas no total, com novas tentativas após 5 segundos, 30 segundos, 2 minutos, 10 minutos e 1 hora; cada tentativa tem um tempo limite geral de 15 segundos. Erros de transporte, tempos limite e respostas não 2xx são repetidas e, após a sexta tentativa fracassada, o evento é marcado failed sem novas tentativas automáticas. Ver Retornos de chamada para o catálogo de eventos, cargas decimais exatas, assinaturas, segurança do destino e detalhes de entrega.
Por quanto tempo um resultado assíncrono pode ser recuperado?
Um resultado assíncrono permanece disponível por 24 horas por meio GET https://p-api.model-gate.com/api/v1/requests/{request_public_id}. Após a expiração, a solicitação e a resposta armazenadas são excluídas e o endpoint retorna 404.
As mutações do parceiro suportam novas tentativas seguras?
Sim. Cada Partner API POST, PATCH, e DELETE requer Idempotency-Key. Tente novamente a mesma operação lógica com a mesma chave após um tempo limite; por 7 dias, o Model Gate retorna o resultado original sem executar a mutação novamente. Reutilizar uma chave para um retorno de solicitação diferente 409.
Por quanto tempo o histórico detalhado de solicitações está disponível?
Segue histórico detalhado de solicitações de parceiros API_REQUESTS_HOT_RETENTION_DAYS (padrão 7 dias) e relata essa janela nos metadados de resposta. Use transações de saldo de conta paginadas por cursor para reconciliação financeira de longo prazo.