AI Gateway Statistiken und Überwachung
Das AI Gateway protokolliert alle Anfragen, die es durchlaufen, und stellt dir auf den Seiten Übersicht (Overview), Statistiken (Statistics) und Überwachung (Monitoring) die Nutzung, Kosten und den Betriebsstatus dar. Dieser Artikel beschreibt Inhalte und Verwendung dieser drei Seiten.
Übersicht (Overview)
Die Übersichtsseite bietet einen Gesamtüberblick über den Status des AI Gateways:
- KPI-Karten — Anzahl aktiver channel, Anzahl virtueller Schlüssel, heutige Anfragen, heutige Kosten (sowie Token-Verbrauch).
- Channel-Integritätsüberblick — Echtzeit-Status jedes channel (normal / degradiert / nicht verfügbar).
- Letzte Ereignisse — Die letzten Routing-Ereignisse (Ereignistyp, Modell, channel, Latenz, Zeit).
Die Übersichtsseite eignet sich für den täglichen schnellen Check, ob das Gateway ordnungsgemäß funktioniert sowie für heutige Ausgaben und Anfragevolumen.
Statistiken (Statistics)
Die Statistikseite dient der detaillierten Analyse von Nutzung und Kosten.
KPI-Zusammenfassung
Oben auf der Seite werden die Kernkennzahlen angezeigt: Anfragen gesamt, Token-Verbrauch gesamt, Kosten (USD), durchschnittliche Latenz (Millisekunden).
Zusammenfassung und Gruppierung
- Gesamtübersicht — Gesamt- / erfolgreiche / fehlgeschlagene Anfragen, Eingabe- / Ausgabe- / Gesamt-Token-Anzahl, durchschnittliche Token pro Anfrage, Gesamtkosten sowie Verteilung nach Ereignistyp (normales Routing routed, Failover failover, fehlgeschlagen failed, kein channel verfügbar no_channel).
- Gruppierung nach Dimensionen — Wechselbare Gruppierungsansichten:
- Nach Modell — Anfragen, Token, Kosten und Latenz je Modell.
- Nach Schlüssel — Verbrauch der jeweiligen virtual key.
- Nach Datum — Nutzungstrend nach Tag.
- Nach Anfragetyp — Gruppierung nach Anfragetyp.
Multimodale Nutzung
Zusätzlich zu Textkonversationen zeigt die Statistikseite separat die multimodale Nutzung: Anzahl generierter Bilder, Spracheingabe-Einheiten, Sprachausgabe-Einheiten, um die Kosten für Bild- und Sprachaufrufe nachzuvollziehen.
Trenddiagramm
Ein Liniendiagramm zeigt den täglich aggregierten Anfrageverlauf und hilft dir, Nutzung Veränderungen zu beobachten.
Budgetverwaltung (VIP)
- Ein Dashboard (Gauge) zeigt den verbrauchten Betrag und Prozentsatz jedes Budgets; bei Annäherung an den Schwellenwert wird eine Warnung ausgegeben.
- Die Budgetverwaltung ist eine kostenpflichtige Funktion. Ohne Abonnement wird dieser Bereich gesperrt und ein Upgrade-Hinweis angezeigt.
Abo-Kontingent-Tracking
Wenn du ein abobasiertes provider-Konto eingebunden hast (siehe Abo-Konten und Kontingent-Tracking), zeigt die Statistikseite auch den Echtzeit-Status der Abo-Kontingente:
- Verwendeter / verbleibender Prozentsatz — Eine Fortschrittsleiste zeigt den Verbrauchsfortschritt jedes Abo-Zeitfensters.
- Kontingent erschöpft — Wenn das Kontingent eines Fensters aufgebraucht ist, wird der entsprechende channel als „erschöpft" markiert und das Gateway führt automatisch ein Downgrade auf einen Ersatzchannel durch (falls failover konfiguriert ist).
- Zurücksetzzeit — Zeigt die Zurücksetzzeit des Kontingentfensters an, um die Wiederherstellungsdauer abzuschätzen.
- Anmeldeinformationsablauf-Hinweis — Wenn die Autorisierungsanmeldeinformationen des Abo-Kontos ablaufen, wird dies auf der Benutzeroberfläche deutlich markiert, um dich zur erneuten Autorisierung aufzufordern.
Die Abo-Kontingentinformationen werden auch im erweiterten Bereich der channel-Liste als Zusammenfassung angezeigt.
Überwachung (Monitoring)
Die Überwachungsseite bietet eine real-time Betriebsansicht:
- Echtzeit-Ereignisprotokoll — Zeigt jedes Routing-Ereignis einzeln an (Anfrage-ID, Modell, channel, Latenz usw.).
- Zählung nach Ereignistyp — Klassifizierte Zählung für normales Routing, fehlgeschlagen, Failover, kein channel verfügbar usw., um Anomalien schnell einzugrenzen.
Voraussetzungen
- Du bist bei deinem ServBay-Konto angemeldet und hast channel und virtual key konfiguriert.
- Es sind bereits tatsächliche Anfragen über das Gateway gelaufen (sonst sind die Statistiken leer).
Empfehlungen
- Kosten steuern — Nutze die Gruppierung „nach Modell / nach Schlüssel", um Quellen mit hohem Verbrauch zu identifizieren. Setze bei Bedarf Ratenlimits für die entsprechende virtual key oder Kontingente für den channel.
- Anomalien beheben — Wenn die Erfolgsquote sinkt, überprüfe den Anteil von failed / no_channel in der Ereignistypverteilung und kombiniere dies mit dem channel-Integritätsstatus, um ausgefallene channel zu lokalisieren.
- Latenz optimieren — Achte auf die durchschnittliche Latenz-KPI und die modellspezifische Latenz, um die Antwortgeschwindigkeit verschiedener provider / Regionsendpunkte zu bewerten.
Häufig gestellte Fragen (FAQ)
- F: Auf der Statistikseite werden keine Daten angezeigt?
- A: Die Statistiken basieren auf tatsächlichen Anfragen über das Gateway. Bitte bestätige, dass bereits eine Anwendung oder ein übernommenes Tool Anfragen über das Gateway gesendet hat.
- F: Der Bereich Budgetverwaltung ist gesperrt?
- A: Die Budgetverwaltung ist eine kostenpflichtige Funktion und wird nach dem Abonnieren des entsprechenden Pakets freigeschaltet.
- F: Wie werden die Kosten berechnet?
- A: Das Gateway schätzt die Kosten anhand der Preisgestaltung jedes channel (einschließlich des von dir festgelegten Preis-multiplikators) und des tatsächlichen Token- / Aufrufvolumens. Die Preisparameter können unter Erweiterte channel-Konfiguration angepasst werden.
Zusammenfassung
Die drei Seiten Übersicht, Statistiken und Überwachung machen jeden Aufruf über das AI Gateway beobachtbar: vom schnellen Überblick über die heutigen Ausgaben über die detaillierte Aufschlüsselung nach Modell / Schlüssel / Datum bis hin zum Echtzeit-Ereignisstrom und der Budgetkontrolle. Wenn du diese Ansichten sinnvoll nutzt, kannst du die Kosten und Stabilität deiner AI-Entwicklung kontinuierlich optimieren.
