Statistiques et surveillance de l'AI Gateway
L'AI Gateway enregistre toutes les requêtes qui la traversent et présente l'utilisation, les coûts et l'état de fonctionnement sur trois pages : Aperçu (Overview), Statistiques (Statistics) et Surveillance (Monitoring). Cet article présente le contenu et l'utilisation de ces trois pages.
Aperçu (Overview)
La page d'aperçu offre une vue d'ensemble de l'état de l'AI Gateway :
- Cartes KPI — Nombre de channels actifs, nombre de virtual keys, nombre de requêtes du jour, coût du jour (et utilisation des Tokens).
- Vue d'ensemble de la santé des channels — État de santé en temps réel de chaque channel (Normal / Dégradé / Indisponible).
- Événements récents — Flux des derniers événements de routage (type d'événement, modèle, channel, latence, heure).
La page d'aperçu est idéale pour vérifier quotidiennement et rapidement si l'AI Gateway fonctionne correctement, ainsi que pour voir les dépenses et le volume de requêtes du jour.
Statistiques (Statistics)
La page de statistiques est utilisée pour une analyse approfondie de l'utilisation et des coûts.
Résumé des KPI
Le haut de la page affiche les indicateurs clés : Nombre total de requêtes, utilisation totale de Tokens, coût (USD), latence moyenne (millisecondes).
Synthèse et regroupement
- Synthèse globale — Nombre de requêtes totales / réussies / échouées, nombre de Tokens d'entrée / de sortie / totaux, nombre moyen de Tokens par requête, coût total, ainsi que la répartition par type d'événement (routé, failover, failed, aucun channel disponible (no_channel)).
- Regroupement par dimension — Possibilité de changer de perspective de regroupement :
- Par modèle — Nombre de requêtes, Tokens, coût, latence pour chaque modèle.
- Par clé — Consommation pour chaque virtual key.
- Par date — Tendance d'utilisation quotidienne.
- Par type de requête — Regroupement par type de requête.
Utilisation multimodale
En plus des conversations textuelles, la page de statistiques affiche séparément l'utilisation multimodale : Nombre d'images générées, unités d'entrée vocale, unités de sortie vocale, facilitant ainsi la comptabilisation des coûts pour les appels d'image et de voix.
Graphiques de tendance
Des graphiques linéaires montrent l'évolution du volume de requêtes agrégées par jour, vous aidant à observer les changements d'utilisation.
Gestion du budget (VIP)
- Affiche sous forme de jauge (gauge) le montant et le pourcentage utilisés pour chaque budget, avec un avertissement lorsque le seuil est proche.
- La gestion du budget est une fonctionnalité payante ; si vous n'êtes pas abonné, cette zone sera verrouillée et vous invitera à mettre à niveau.
Suivi du quota d'abonnement
Si vous avez lié un compte de provider basé sur un abonnement (voir Compte d'abonnement et suivi du quota), la page de statistiques affichera également l'état en temps réel du quota d'abonnement :
- Pourcentage utilisé / restant — Affiche sous forme de barre de progression l'avancement de la consommation du quota pour chaque fenêtre d'abonnement.
- État d'épuisement du quota — Lorsque le quota d'une fenêtre est épuisé, le channel correspondant sera marqué comme « Épuisé », et l'AI Gateway effectuera automatiquement un repli vers un channel de secours (si le failover est configuré).
- Heure de réinitialisation — Affiche l'heure de réinitialisation de la fenêtre de quota, pour vous aider à estimer le temps de récupération.
- Avertissement d'expiration des identifiants — Lorsque les identifiants d'autorisation du compte d'abonnement expirent, l'interface les marquera clairement pour vous rappeler de vous réautoriser.
Les informations sur le quota d'abonnement seront également affichées sous forme de résumé dans la zone dépliable de la liste des channels.
Surveillance (Monitoring)
La page de surveillance offre une vue de fonctionnement plus en temps réel :
- Journal des événements en temps réel — Affiche chaque événement de routage individuellement (ID de requête, modèle, channel, latence, etc.).
- Comptage par type d'événement — Comptage par catégorie tel que routage normal, échec, failover, aucun channel disponible, etc., facilitant la localisation rapide des anomalies.
Conditions préalables
- Vous devez être connecté à un compte ServBay et avoir configuré des channels et des virtual keys.
- Des requêtes réelles doivent avoir traversé l'AI Gateway (sinon les statistiques seront vides).
Conseils d'utilisation
- Contrôler les coûts — Utilisez le regroupement « Par modèle / Par clé » pour identifier les sources de forte consommation et, si nécessaire, définissez des limites de débit pour les virtual keys correspondantes ou des quotas pour les channels.
- Dépanner les anomalies — Si le taux de succès diminue, vérifiez la proportion de failed / no_channel dans la répartition par type d'événement et combinez-la avec l'état de santé des channels pour localiser les channels défaillants.
- Optimiser la latence — Surveillez le KPI de latence moyenne et la latence par modèle pour évaluer la vitesse de réponse des différents endpoints de provider / région.
Foire aux questions (FAQ)
- Q : La page de statistiques n'a pas de données ?
- R : Les statistiques sont basées sur les requêtes réelles traversant l'AI Gateway. Veuillez confirmer qu'une application ou un outil géré a déjà envoyé des requêtes via l'AI Gateway.
- Q : La zone de gestion du budget est verrouillée ?
- R : La gestion du budget est une fonctionnalité payante, accessible après souscription à l'offre correspondante.
- Q : Comment les coûts sont-ils calculés ?
- R : L'AI Gateway estime les coûts en fonction de la tarification de chaque channel (y compris le multiplicateur de tarification que vous avez défini) et du volume réel de Tokens / d'appels. Les paramètres de tarification peuvent être ajustés dans la Configuration avancée des channels.
Résumé
Les trois pages Aperçu, Statistiques et Surveillance rendent chaque appel de l'AI Gateway observable : d'un aperçu rapide des dépenses du jour à une ventilation approfondie par modèle / clé / date, en passant par le flux d'événements en temps réel et le contrôle budgétaire. En tirant parti de ces vues, vous pouvez continuellement optimiser les coûts et la stabilité de votre développement IA.
