Estatísticas e Monitoramento do AI Gateway
O AI Gateway registrará todas as solicitações que passam por ele e apresentará o uso, os custos e o status operacional nas páginas de Visão Geral (Overview), Estatísticas (Statistics) e Monitoramento (Monitoring). Este artigo apresenta o conteúdo e o uso dessas três páginas.
Visão Geral (Overview)
A página de visão geral fornece um panorama do status geral do AI Gateway:
- Cartões de KPI — Número de channels ativos, número de virtual keys, solicitações de hoje, custo de hoje (e uso de Tokens).
- Visão geral da saúde do channel — Status de saúde em tempo real de cada channel (Normal / Degradado / Indisponível).
- Eventos recentes — Fluxo dos eventos de roteamento mais recentes (tipo de evento, modelo, channel, latência, tempo).
A página de visão geral é adequada para uma verificação rápida diária para saber se o gateway está normal, bem como os gastos e o volume de solicitações de hoje.
Estatísticas (Statistics)
A página de estatísticas é usada para uma análise profunda do uso e dos custos.
Resumo de KPI
A parte superior da página exibe as métricas principais: Número total de solicitações, Uso total de Tokens, Custo (USD), Latência média (milissegundos).
Resumo e Agrupamento
- Resumo geral — Número de solicitações totais / bem-sucedidas / com falha, número de Tokens de entrada / saída / total, número médio de Tokens por solicitação, custo total e distribuição por tipo de evento (Roteamento normal routed, Failover failover, Falha failed, Sem channel disponível no_channel).
- Agrupamento por dimensão — Alternar a perspectiva de agrupamento:
- Por modelo — Solicitações, Tokens, custo e latência de cada modelo.
- Por chave — Consumo de cada virtual key.
- Por data — Tendência de uso diário.
- Por tipo de solicitação — Agrupado por tipo de solicitação.
Uso Multimodal
Além das conversas de texto, a página de estatísticas também mostra separadamente o uso multimodal: Quantidade de geração de imagens, Unidades de entrada de voz, Unidades de saída de voz, para facilitar a contabilização dos custos de chamadas de imagem e voz.
Gráfico de Tendências
Um gráfico de linhas mostra a tendência do volume de solicitações agregadas por dia, ajudando você a observar as mudanças no uso.
Gerenciamento de Orçamento (VIP)
- A cota usada e a porcentagem de cada orçamento são exibidas na forma de um medidor (gauge), fornecendo um aviso quando se aproxima do limite.
- O gerenciamento de orçamento é um recurso pago; se não houver assinatura, essa área será bloqueada e solicitará a atualização.
Rastreamento de Cota de Assinatura
Se você vinculou uma conta de provider com assinatura (consulte Conta de Assinatura e Rastreamento de Cota), a página de estatísticas também mostrará o status em tempo real da cota de assinatura:
- Porcentagem usada / restante — O progresso do consumo da cota para cada janela de assinatura é mostrado em forma de barra de progresso.
- Status de cota esgotada — Quando a cota de uma janela se esgota, o channel correspondente será marcado como "Esgotado" e o gateway fará o downgrade automático para um channel de backup (se o failover estiver configurado).
- Tempo de redefinição — Mostra o tempo de redefinição da janela de cota, ajudando você a estimar o tempo de recuperação.
- Aviso de credenciais inválidas — Quando as credenciais de autorização da conta de assinatura expiram, isso será claramente marcado na interface, lembrando-o de autorizar novamente.
As informações da cota de assinatura também serão exibidas em formato de resumo na área expandida da Lista de Channels.
Monitoramento (Monitoring)
A página de monitoramento fornece uma visão operacional mais em tempo real:
- Log de eventos em tempo real — Exibe os eventos de roteamento um por um (ID da solicitação, modelo, channel, latência, etc.).
- Contagem por tipo de evento — Contagem categorizada de roteamento normal, falha, failover, sem channel disponível, etc., facilitando a localização rápida de anomalias.
Pré-requisitos
- Você deve estar logado em uma conta ServBay e ter configurado os channels e as virtual keys.
- Já existem solicitações reais passando pelo gateway (caso contrário, as estatísticas estarão vazias).
Sugestões de Uso
- Controlar custos — Use o agrupamento "Por modelo / Por chave" para encontrar fontes de alto consumo e, se necessário, defina limites de taxa para a virtual key correspondente ou configure cotas para o channel.
- Solucionar anomalias — Se a taxa de sucesso cair, verifique a proporção de failed / no_channel na distribuição de tipos de eventos e combine com o status de saúde do channel para localizar o channel com falha.
- Otimizar latência — Preste atenção ao KPI de latência média e à latência por modelo para avaliar a velocidade de resposta de diferentes providers / endpoints regionais.
Perguntas Frequentes (FAQ)
- P: A página de estatísticas não tem dados?
- R: As estatísticas são baseadas em solicitações reais que passam pelo gateway. Confirme se algum aplicativo ou ferramenta gerenciada já fez solicitações através do gateway.
- P: A área de gerenciamento de orçamento está bloqueada?
- R: O gerenciamento de orçamento é um recurso pago e pode ser usado após assinar o plano correspondente.
- P: Como os custos são calculados?
- R: O gateway estima o custo com base no preço de cada channel (incluindo o multiplicador de preço que você definiu) e no uso real de Tokens / chamadas. Os parâmetros de preço podem ser ajustados nas Configurações Avançadas do Channel.
Resumo
As três páginas de Visão Geral, Estatísticas e Monitoramento tornam cada chamada do AI Gateway observável: desde uma rápida olhada nos gastos de hoje até um detalhamento profundo por modelo / chave / data, passando pelo fluxo de eventos em tempo real e controle de orçamento. Fazendo bom uso dessas visualizações, você pode otimizar continuamente o custo e a estabilidade do desenvolvimento de IA.
