Estadísticas y Monitoreo de AI Gateway
AI Gateway registra todas las solicitudes que pasan a través de él y te presenta el uso, los costos y el estado de funcionamiento en las páginas de Overview, Statistics y Monitoring. Este artículo presenta el contenido y el uso de estas tres páginas.
Overview
La página de Overview ofrece una vista general del estado del AI Gateway:
- Tarjetas KPI — Número de channels activos, número de virtual keys, solicitudes de hoy, costo de hoy (y uso de Tokens).
- Vista general de salud de channels — Estado de salud en tiempo real de cada channel (normal / degradado / no disponible).
- Eventos recientes — Flujo de los últimos eventos de enrutamiento (tipo de evento, modelo, channel, latencia, tiempo).
La página de Overview es ideal para comprobar rápidamente en el día a día si el gateway funciona con normalidad, así como el gasto y el volumen de solicitudes de hoy.
Statistics
La página de Statistics se utiliza para analizar a fondo el uso y los costos.
Resumen de KPI
La parte superior de la página muestra las métricas clave: Número total de solicitudes, uso total de Tokens, costo (USD), latencia media (milisegundos).
Resumen y Agrupación
- Resumen general — Número de solicitudes totales / exitosas / fallidas, número de Tokens de entrada / salida / totales, número medio de Tokens por solicitud, costo total y distribución por tipo de evento (enrutamiento normal routed, conmutación por error failover, fallido failed, sin channel disponible no_channel).
- Agrupación por dimensión — Puedes cambiar entre diferentes vistas agrupadas:
- Por modelo — Solicitudes, Tokens, costo y latencia de cada modelo.
- Por clave — Consumo de cada virtual key.
- Por fecha — Tendencia de uso diario.
- Por tipo de solicitud — Agrupado por tipo de solicitud.
Uso Multimodal
Además de las conversaciones de texto, la página de Statistics también muestra por separado el uso multimodal: Cantidad de imágenes generadas, unidades de entrada de voz, unidades de salida de voz, lo que facilita contabilizar los gastos de las llamadas de imágenes y voz.
Gráfico de Tendencias
Muestra la tendencia del volumen de solicitudes agregadas diariamente mediante un gráfico de líneas, ayudándote a observar los cambios en el uso.
Gestión de Presupuesto (VIP)
- Muestra la cuota utilizada y el porcentaje de cada presupuesto en forma de medidor (gauge), y proporciona una alerta cuando se acerca al umbral.
- La gestión de presupuestos es una función de pago; si no estás suscrito, esta área se bloqueará y sugerirá actualizar.
Seguimiento de Cuota de Suscripción
Si has vinculado una cuenta de provider de suscripción (consulta Cuentas de Suscripción y Seguimiento de Cuota para más detalles), la página de Statistics también mostrará el estado en tiempo real de la cuota de suscripción:
- Porcentaje usado / restante — Muestra el progreso de consumo de la cuota de cada ventana de suscripción en forma de barra de progreso.
- Estado de cuota agotada — Cuando se agota la cuota de una ventana, el channel correspondiente se marcará como "Agotado" y el gateway degradará automáticamente a un channel de respaldo (si está configurado failover).
- Hora de reinicio — Muestra la hora de reinicio de la ventana de cuota, ayudándote a estimar el tiempo de recuperación.
- Aviso de credenciales caducadas — Cuando las credenciales de autorización de la cuenta de suscripción caducan, se marcará claramente en la interfaz para recordarte que debes volver a autorizar.
La información de la cuota de suscripción también se mostrará en formato de resumen en la sección expandible de la Lista de channels.
Monitoring
La página de Monitoring proporciona una vista de operación más en tiempo real:
- Registro de eventos en tiempo real — Muestra cada evento de enrutamiento individualmente (ID de solicitud, modelo, channel, latencia, etc.).
- Recuento por tipo de evento — Recuento clasificado de enrutamiento normal, fallido, failover, sin channel disponible, etc., para localizar rápidamente anomalías.
Requisitos Previos
- Haber iniciado sesión en tu cuenta de ServBay y haber configurado los channels y las virtual keys.
- Haber tenido solicitudes reales pasando por el gateway (de lo contrario, las estadísticas estarán vacías).
Recomendaciones de Uso
- Controlar costos — Usa la agrupación "Por modelo / Por clave" para encontrar las fuentes de alto consumo y, si es necesario, establece límites de tasa para las virtual keys correspondientes o establece cuotas para los channels.
- Solucionar anomalías — Si la tasa de éxito disminuye, revisa la proporción de failed / no_channel en la distribución de tipos de eventos y utiliza el estado de salud del channel para localizar los channels fallidos.
- Optimizar latencia — Presta atención al KPI de latencia media y a la latencia por modelo para evaluar la velocidad de respuesta de diferentes providers / puntos de conexión regionales.
Preguntas Frecuentes (FAQ)
- P: ¿La página de Statistics no muestra datos?
- R: Las estadísticas se basan en solicitudes reales que pasan por el gateway. Confirma que alguna aplicación o herramienta conectada haya realizado solicitudes a través del gateway.
- P: ¿El área de Gestión de Presupuesto está bloqueada?
- R: La gestión de presupuestos es una función de pago. Puedes utilizarla después de suscribirte al plan correspondiente.
- P: ¿Cómo se calculan los costos?
- R: El gateway estima los costos basándose en los precios de cada channel (incluyendo el multiplicador de precios que hayas configurado) y el uso real de Tokens / llamadas. Puedes ajustar los parámetros de precios en la Configuración avanzada de channels.
Resumen
Las tres páginas de Overview, Statistics y Monitoring hacen que cada llamada del AI Gateway sea observable: desde un vistazo rápido a los gastos de hoy, hasta un desglose profundo por modelo / clave / fecha, pasando por flujos de eventos en tiempo real y la gestión de presupuestos. Utilizando adecuadamente estas vistas, puedes optimizar continuamente el costo y la estabilidad del desarrollo con AI.
