Kanäle im AI-Gateway verwalten
„Kanal (Channel)“ ist die Konfiguration eines Anbieterzugangspunkts im AI-Gateway – er speichert die Adresse eines Anbieters, den echten API Key, verfügbare Modelle sowie Preis- und Kontingentinformationen. Das Gateway leitet anhand dieser Kanäle die von Anwendungen gesendeten Anfragen an den entsprechenden Anbieter weiter. Dieser Artikel beschreibt, wie Sie Kanäle hinzufügen, konfigurieren, testen und verwalten.
Voraussetzungen
- ServBay ist installiert und läuft, und Sie sind bei Ihrem ServBay-Konto angemeldet (vor dem Hinzufügen eines Kanals ist eine Anmeldung erforderlich).
- Der echte API Key des Zielanbieters liegt vor (bei lokalen Anbietern wie Ollama / LM Studio kann er leer bleiben).
- Falls Sie die Gesamtarchitektur des AI-Gateways noch nicht kennen, lesen Sie bitte zuerst die AI-Gateway-Einführung.
Kanal hinzufügen
Gehen Sie zur Seite AI-Gateway → Kanäle (Channels) und klicken Sie auf Hinzufügen (Add), um den Assistenten zu öffnen. Der Assistent besteht aus drei Schritten.
Schritt 1: Anbieter auswählen
Die Anbieter werden nach Kategorien gruppiert angezeigt; klicken Sie auf eine Karte, um sie auszuwählen:
- Mainstream (Mainstream): OpenAI, Anthropic, Google Gemini, Azure OpenAI, AWS Bedrock, OpenRouter.
- China (China): DeepSeek, Tongyi Qianwen, Zhipu GLM, Kimi, Doubao·Volcano, Wenxin Yiyan, Hunyuan, MiniMax, 01.AI, StepFun.
- Lokal (Local): Ollama, LM Studio.
- Benutzerdefiniert (Custom): OpenAI Compatible, Custom.
Nach Auswahl des Anbieters trägt das Gateway automatisch die Standard-Base-URL des Anbieters ein.
Dual-Region-Umschaltung
Chinesische Anbieter wie Tongyi Qianwen, Zhipu GLM, Kimi, Doubao·Volcano, Hunyuan, MiniMax und StepFun bieten sowohl inländische als auch globale Endpunkte an. Bei Auswahl solcher Anbieter erscheint im Assistenten ein „Region“-Auswahlfeld (🇨🇳 Inland / 🌐 Global); nach dem Umschalten wird die Base-URL automatisch auf die Adresse der entsprechenden Region aktualisiert.
Schritt 2: Konfiguration ausfüllen
- Kanalname (erforderlich) — dient zur Identifizierung des Kanals in der Liste, kann benutzerdefiniert sein.
- Base URL (erforderlich) — API-Adresse des Anbieters. Bei den meisten Anbietern bereits vorausgefüllt; bei Azure OpenAI und Custom müssen Sie sie manuell eingeben.
- API Key (optional) — der echte Schlüssel des Anbieters. Wenn er leer bleibt, kann nur die Erreichbarkeit des Endpunkts getestet werden, nicht die Gültigkeit des Schlüssels; bei lokalen Anbietern (Ollama / LM Studio) ist normalerweise keine Eingabe erforderlich.
- Modelle — es gibt zwei Möglichkeiten, wählen Sie eine:
- Automatische Erkennung: Nach dem Klick auf „Erkennen“ ruft das Gateway die Modellliste des Anbieters ab, und Sie können die verfügbaren Modelle per Chip-Mehrfachauswahl auswählen.
- Manuelle Eingabe: Geben Sie den Modellnamen direkt ein. Bei Azure-Kanälen muss der Deployment-Name anstelle des Modellnamens eingegeben werden.
- Priorität / Gewichtung — wenn mehrere Kanäle dasselbe Modell bedienen können, entscheidet das Gateway anhand dieser Angaben über Routing und Lastverteilung.
Hinweis zu Azure OpenAI
Im Feld „Modelle“ eines Azure-Kanals sollte der Deployment-Name eingegeben werden, den Sie im Azure-Portal erstellt haben, nicht der zugrunde liegende Modellname. Auch die Base-URL muss den Endpunkt Ihrer Azure-Ressource enthalten.
Schritt 3: Bestätigen und absenden
Überprüfen Sie die Konfigurationszusammenfassung und senden Sie sie ab. Nach erfolgreichem Absenden erscheint der neue Kanal in der Kanalliste und zeigt den Echtzeit-Gesundheitsstatus an.
Fähigkeitserkennung und Routing-Strategie
Nach dem Hinzufügen eines Kanals führt das Gateway eine Capability-Probing (Fähigkeitserkennung) für diesen Kanal durch – dies ist der zentrale intelligente Routing-Mechanismus des AI-Gateways. Die Ergebnisse der Erkennung bestimmen, ob Tools wie Claude Code direkt verwendet werden können, ob eine Modellzuordnung erstellt werden muss und wie das Zielmodell ausgewählt wird.
Die beiden Schlüsselindikatoren der Erkennung
Das Gateway ermittelt für jeden Kanal zwei Kernfakten (jeweils dreiwertig: true / false / unbestimmt):
| Prüfpunkt | Bedeutung | true | false | Unbestimmt |
|---|---|---|---|---|
Erkennt Claude-Modellnamen (accepts_claude_names) | Ob der Kanal die Modellnamen claude-opus-* / claude-sonnet-* / claude-haiku-* nativ erkennt | Direkte Verbindung möglich, keine Zuordnung nötig | Wird nicht erkannt, eine Zuordnung muss erstellt werden, um claude-* Namen in die echten Upstream-Modellnamen zu übersetzen | Erkennung wurde nicht ausgeführt oder ist fehlgeschlagen, keine Schlussfolgerung möglich |
Unterscheidet nach Stufe (tier_aware) | Ob der Upstream selbst je nach opus / sonnet / haiku-Stufe unterschiedliche Modelle zurückgibt | Upstream unterscheidet bereits, kann direkt an den Upstream übergeben werden | Keine Unterscheidung (gibt für alle Stufen dasselbe Modell zurück), das Gateway muss eine Zuordnung erstellen | Kann nicht ermittelt werden oder wurde nicht geprüft |
Warum erkennen statt raten
Das Verhalten verschiedener Anbieter ist sehr unterschiedlich. OpenAI erkennt claude-*-Modellnamen von Haus aus nicht; einige Zwischenanbieter erkennen sie durch Weiterleitung; und Coding-Abonnement-Anbieter (z. B. Claude Pro/Max-Abonnements) erkennen möglicherweise nur die an das Abonnement gebundenen spezifischen Modellnamen. Das Gateway rät nicht anhand des Kanaltyps, sondern entscheidet nach tatsächlicher Erkennung über die Routing-Strategie.
Routing-Entscheidung: fünf Zustände
Wenn Sie im AI Gateway → Zugriffsverwaltung → Client-Seite eine „Ein-Klick-Übernahme“ für Claude Code durchführen, aggregiert das Gateway die Erkennungsergebnisse aller Kandidatenkanäle und gelangt zu einer Routing-Entscheidung:
| Status der Kandidatenkanäle | Entscheidung | Bedeutung |
|---|---|---|
| Keine verfügbaren Kandidatenkanäle (kein Kanal / alle ungesund / keine Kanäle im Geltungsbereich des virtuellen Schlüssels) | Keine Kandidatenkanäle | Sie müssen zuerst Kanäle hinzufügen oder reparieren |
| Der Erkennungswert mindestens eines Kandidatenkanals ist unbestimmt | Nicht geprüft | Zuerst eine Erkennung durchführen, es darf keine Zuordnung ohne Verifizierung erstellt werden |
| Alle Kandidatenkanäle erkennen den Claude-Modellnamen | Direktverbindung | Keine Zuordnung, Anfragen werden unverändert weitergeleitet |
| Keiner der Kandidatenkanäle erkennt den Claude-Modellnamen | Zuordnung erforderlich | Das Gateway erstellt eine Zuordnung für drei Stufen und übersetzt claude-* in die echten Upstream-Modellnamen |
| Einige Kandidaten erkennen ihn, andere nicht | Gemischt | Manuelle Entscheidung erforderlich (erkennende direkt, nicht erkennende über Zuordnung) |
Modellzuordnung: claude-* in echte Upstream-Modelle übersetzen
Wenn die Entscheidung „Zuordnung erforderlich“ lautet, erstellt das Gateway drei Modellzuordnungsregeln für Claude Code, die jeweils drei Stufen abdecken:
| Von Claude Code gesendeter Modellname | Zuordnungsregel (Wildcard) | Zugeordnet zu |
|---|---|---|
claude-opus-* | Entspricht allen Anfragen der Opus-Stufe | Flaggschiffmodell unter den Kandidatenkanälen |
claude-sonnet-* | Entspricht allen Anfragen der Sonnet-Stufe | Flaggschiffmodell oder Standardmodell unter den Kandidatenkanälen |
claude-haiku-* | Entspricht allen Anfragen der Haiku-Stufe | Leichtgewichtmodell unter den Kandidatenkanälen |
Regeln zur Auswahl des Zielmodells (Rückfall nach Priorität):
- Familienvoreinstellung: Wenn in den Kandidatenmodellen ein bekanntes Familien-Schlüsselwort (z. B.
glm) auftaucht, wird direkt das Flaggschiff dieser Familie (z. B.glm-5.2) als Ziel für die Opus-/Sonnet-Stufe und das Leichtgewicht dieser Familie (z. B.glm-4.7-flash) als Ziel für die Haiku-Stufe genommen. - Schlüsselwortabgleich: Wenn keine Familienvoreinstellung vorhanden ist, wird für Opus/Sonnet das erste Modell der Kandidatenliste genommen; für Haiku das erste Modell unter den Kandidaten, das auf ein Leichtgewicht-Schlüsselwort (
flash/mini/lite/air/small/turbo/haiku) passt. - Fallback: Wenn immer noch kein Treffer erzielt wird, wird für alle drei Stufen das erste Modell der Kandidatenliste genommen.
Fehlbesetzung der Haiku-Stufe ist am teuersten
Die Haiku-Stufe von Claude Code wird am häufigsten aufgerufen (jeder leichte Aufruf während eines Gesprächs nutzt sie). Wenn versehentlich ein Flaggschiffmodell in die Haiku-Stufe eingetragen wird, können sich die Kosten vervielfachen. Die Schlüsselwortabgleich-Tabelle des Gateways deckt 7 Leichtgewicht-Suffixe ab (flash / mini / lite / air / small / turbo / haiku), um sicherzustellen, dass keine schweren Modelle in die Haiku-Stufe eingetragen werden.
Mechanismus des Schreibens von Zuordnungen
Nach der Bestätigung der Übernahme schreibt das Gateway die Zuordnungsdatensätze über die /admin/model-mappings-API. Jeder Zuordnungsdatensatz enthält:
- Quellprotokoll (
source_protocol):anthropic(die von Claude Code gesendeten Anfragen haben das Anthropic-Format) - Quellmodell-Muster (
source_model_pattern): Wildcard, z. B.claude-opus-* - Zielprotokoll (
target_protocol):openai(wird einheitlich in das OpenAI-Format konvertiert und an den Upstream gesendet) - Zielmodell (
target_model): der durch die Erkennung ausgewählte konkrete Modellname
Das Schreiben ist idempotent – eine wiederholte Übernahme erzeugt keine doppelten Zuordnungen; vor dem Schreiben wird die vorhandene Zuordnungsliste zum Abgleich abgerufen.
Laufzeit-Routing-Regeln: Failover und Downgrade
Neben den während der Übernahmephase geschriebenen statischen Zuordnungen unterstützt das Gateway auch Laufzeit-Routing-Regeln (routing rules), die bei der Weiterleitung einer Anfrage durch das Gateway dynamisch entscheiden:
| Regel-Feld | Funktion |
|---|---|
Auslösebedingung (condition_type) | Wann ein Downgrade ausgelöst wird, z. B. wenn das Kontingent des Kanals erschöpft ist (quota_exhausted) |
Kostenschwelle (cost_threshold_usd) | Optional: wird ausgelöst, wenn die kumulierten Kosten dieses Kanals die Schwelle überschreiten |
Aktion (action_type) | Was nach der Auslösung geschieht, z. B. Wechsel zu einem angegebenen Ersatkanal (switch_to) |
Zielkanal (target_channel_id) | Der Ersatkanal, auf den herabgestuft wird |
Zielmodell (target_model) | Optional: gleichzeitiger Modellwechsel beim Wechsel zum Ersatkanal |
Durch die Kombination mehrerer Routing-Regeln können Sie Folgendes erreichen: Wenn das Abonnementkontingent von Kanal A erschöpft ist, automatisch zum pay-as-you-go-Endpunkt von Kanal B wechseln; wenn die 24-Stunden-Kosten eines Kanals das Limit überschreiten, auf ein günstigeres Modell herabstufen.
Lastverteilung und Priorität
Wenn mehrere gesunde Kanäle dasselbe Modell bedienen können, wählt das Gateway nach folgender Strategie:
- Prioritätsmodus (Standard): Es wird nur der Kanal mit der höchsten Priorität gewählt; unter Kanälen gleicher Priorität verteilt das Gateway nach internen Gewichten.
- Round-Robin-Modus (
round_robin): Anfragen werden abwechselnd auf alle gesunden Kandidatenkanäle verteilt.
Die Priorität wird in der Kanalkonfiguration festgelegt (je höher die Zahl, desto höher die Priorität); die allowed_channels des virtuellen Schlüssels begrenzen den Bereich der wählbaren Kanäle.
Konnektivitätstest
In der Kanalliste kann für einen einzelnen Kanal ein Konnektivitätstest durchgeführt werden. Der Test umfasst zwei Dimensionen:
- Endpunkt-Erreichbarkeit (reachable) — prüft, ob die Base-URL erreichbar ist (ob Netzwerk und Adresse korrekt sind).
- Schlüsselgültigkeit (authenticated) — ruft tatsächlich die Anbieterschnittstelle auf, um zu prüfen, ob der API Key gültig ist. Wird nur bei eingegebenem API Key verifiziert.
Die Testergebnisse zeigen: Round-Trip-Latenz (Millisekunden), Statusabzeichen sowie Fehlermeldungen.
TIP
Wenn im Hinzufügen-Assistenten der Endpunkt nicht erreichbar ist, wird der Wechsel zum nächsten Schritt blockiert. Wenn der Endpunkt erreichbar ist, aber der Schlüssel ungültig ist, wird nur eine Warnung angezeigt, und Sie können fortfahren (z. B. wenn Sie den Schlüssel später ergänzen möchten).
Erweiterte Konfiguration
Beim Hinzufügen oder Bearbeiten eines Kanals können Sie die erweiterte Konfiguration aufklappen, um Kostenkalkulation und Kontingentsteuerung zu nutzen:
- Preismultiplikator (Rate Multiplier) — multipliziert den offiziellen Preis des Anbieters mit einem Faktor, um Ihre tatsächlichen Kosten oder Wiederverkaufspreise abzubilden; Standard ist
1.0. - Abrechnungsstruktur — beschreibt die Abrechnungsmethode des Kanals, z. B. pay as you go, Abonnement (subscription), Paket (package).
- Guthaben — die Guthabenquelle kann ein fester Wert, OSS-Abrechnung oder manuell gepflegt sein; bei OSS-Abrechnung kann zusätzlich der Abrechnungstyp angegeben werden. Guthaben und Aktualisierungszeit werden in den Kanaletails schreibgeschützt angezeigt.
- Ablaufdatum des Abonnements — bei Abonnement-/Paketkanälen kann das Ablaufdatum erfasst werden.
- Kontingentgrenzen — es können Obergrenzen nach Token-Anzahl, Anfragenzahl oder Betrag festgelegt und ein Zeitraum (täglich / wöchentlich / monatlich / benutzerdefiniert) gewählt werden. Nach Erschöpfung des Kontingents wird der Kanal automatisch aus der Weiterleitung ausgeschlossen; dies ist ein Sicherheitsventil gegen unerwartete Überschreitungen.
Kanäle bearbeiten und löschen
- Bearbeiten — öffnen Sie einen Kanal in der Kanalliste, um Name, Base-URL, API Key, Modelle und erweiterte Konfiguration zu ändern.
- Löschen — nach dem Löschen eines Kanals können virtuelle Schlüssel, die von ihm abhängen, nicht mehr darüber geleitet werden; gehen Sie daher vorsichtig vor.
Gesundheitsstatus
Die Kanalliste und die Übersichtsseite zeigen in Echtzeit den Gesundheitsstatus der einzelnen Kanäle an (normal / herabgestuft / nicht verfügbar), damit Sie fehlerhafte Anbieterkonfigurationen schnell erkennen.
Häufig gestellte Fragen (FAQ)
- F: Beim Hinzufügen eines Kanals wird eine Anmeldung verlangt?
- A: Das AI-Gateway ist eine Mehrwertfunktion von ServBay. Vor dem Hinzufügen von Kanälen / Schlüsseln müssen Sie sich bei Ihrem ServBay-Konto anmelden. Folgen Sie einfach der Anleitung in der Benutzeroberfläche.
- F: Es wird gemeldet, dass die maximale Anzahl an Kanälen erreicht ist?
- A: Die Anzahl der erstellbaren Kanäle hängt vom Kontopaket ab. Wenn die Obergrenze erreicht ist, können Sie nicht benötigte Kanäle löschen oder Ihr Paket upgraden.
- F: Die automatische Modellerkennung ruft keine Liste ab?
- A: Bitte prüfen Sie zunächst, ob die Base-URL korrekt und der API Key gültig ist (verwenden Sie den „Schlüsselgültigkeit“-Test des Konnektivitätstests). Einige Anbieter geben die Modellliste nur bei gültigem Schlüssel zurück; alternativ können Sie den Modellnamen manuell eingeben.
- F: Muss für die Anbindung von lokalem Ollama / LM Studio ein Key eingegeben werden?
- A: Normalerweise nicht. Stellen Sie sicher, dass der entsprechende lokale Dienst gestartet ist und auf dem Standardport lauscht (Ollama
11434, LM Studio1234).
- A: Normalerweise nicht. Stellen Sie sicher, dass der entsprechende lokale Dienst gestartet ist und auf dem Standardport lauscht (Ollama
Zusammenfassung
Kanäle sind die Grundlage für das Routing von Anfragen im AI-Gateway. Über den dreistufigen Assistenten können Sie schnell fast 20 Anbieter anbinden. Nutzen Sie die Dual-Region-Umschaltung, die automatische Modellerkennung und den zweidimensionalen Konnektivitätstest, um eine korrekte Konfiguration sicherzustellen, und verwalten Sie die Kosten mit erweiterten Konfigurationen wie Preisgestaltung und Kontingenten präzise. Nach der Konfiguration der Kanäle können Sie virtuelle Schlüssel für Anwendungen und Tools erstellen.
