ServBay AI ゲートウェイ(AI Gateway)の紹介
ServBay AI ゲートウェイ(AI Gateway)は ServBay に組み込まれたローカル統合 AI プロバイダーゲートウェイです。お使いのマシン上でプロキシエンドポイントを実行し、各 LLM プロバイダー(OpenAI、Anthropic、DeepSeek、通義千問など約 20 社)へ送信されるリクエストを 1 つのエントリポイントに集約します。キーの一元管理、使用量とコストの集計を支援し、Claude Code や Codex などの AI コーディングツールをワンクリックでローカルゲートウェイに向けることができます。
本ドキュメントでは、AI ゲートウェイとは何か、どのような課題を解決するのか、そして全体アーキテクチャについて説明します。具体的な操作方法は以下を参照してください:
- チャネルの管理 — 各プロバイダーの追加と設定
- 仮想キー — キーの作成、権限設定、ローテーション、失効
- AI コーディングツールのワンクリック引き継ぎ — Claude Code などの CLI をゲートウェイに向ける
- 統計とモニタリング — 使用量、コスト、予算
- エンドポイントと環境変数 — 自分のコードからゲートウェイを呼び出す
概要
日常的な AI 開発では、複数プロバイダーの API Key を同時に保持し、それらがさまざまなプロジェクトやツールの設定ファイルに散在していることがあります。そうなると支出の集計が難しく、一括で切り替えるのも困難です。ServBay AI ゲートウェイは、こうした問題を 1 か所に集約します:
- 1 つのエントリで複数プロバイダーに接続 — 各チャネルを設定すれば、すべてのリクエストはローカルの
http://127.0.0.1:11580を経由して転送され、アプリケーションは 1 つのアドレスだけを意識すればよくなります。 - 仮想キーが実キーを代替 — ゲートウェイはアプリやツールに発行する「仮想キー」を発行します。実際のプロバイダー API Key はゲートウェイ側にのみ保存され、あちこちに散らばることはありません。仮想キーはいつでも権限を制限し、ローテーションし、失効させられます。
- 統一された使用量とコストの可視化 — ゲートウェイを経由したすべてのリクエストが記録され、リクエスト数、Token 使用量、コスト、レイテンシ、マルチモーダル使用量などの統計を提供し、予算管理もサポートします。
- 主要な AI コーディングツールをワンクリックで引き継ぎ — 設定ファイルを手動で編集する必要はありません。ゲートウェイは Claude Code、Codex、Qwen Code、Kimi CLI、CodeBuddy、opencode、Crush などのツールをワンクリックでローカルゲートウェイに向けることができます。
- サブスクリプションアカウントとクォータの追跡 — サブスクリプション型プロバイダーアカウント(Claude Pro / Max の OAuth 認証など)の連携をサポートし、プラン情報、利用可能なエンドポイント、出力長制限をゲートウェイ内で可視化して表示し、複数ウィンドウのクォータ(使用済み / 残りの割合、クォータ枯渇状態、リセット時間)をリアルタイムで追跡します。これにより、サブスクリプションの残量をいつでも把握できます。
- チャネル機能の検出とスマートルーティング — チャネルを追加すると、ゲートウェイがプロバイダーの機能(OAuth 認証型 / コーディングプラン型 / ティアモデル型)を自動検出します。確認後、検出結果に応じて 3 段階のゲートウェイマッピングが自動的に書き込まれ、モデルの互換性を手動で推測する必要がありません。
アーキテクチャとポート
AI ゲートウェイは 2 つのローカルサービスで構成され、いずれもループバックアドレス(127.0.0.1)のみをリッスンします:
| ポート | 用途 | 説明 |
|---|---|---|
11580 | プロキシポート | アプリケーション向けの統一エントリ。あなたのコードと引き継いだ AI ツールはすべてここにリクエストを送信し、ゲートウェイは仮想キーの権限に応じて対応するプロバイダーチャネルへルーティングします。 |
11581 | 管理ポート | ServBay アプリが内部でチャネル、キー、統計データを管理するために使用します。通常は直接アクセスする必要はありません。 |
プロキシポートは複数の互換フォーマットのエンドポイント(OpenAI 互換、Anthropic 互換、Gemini 互換)を同時に提供します。詳しくはエンドポイントと環境変数を参照してください。
対応プロバイダーチャネル
AI ゲートウェイには約 20 のプロバイダープリセットが組み込まれており、カテゴリ別にグループ化されているため、チャネル追加時に直接選択できます:
- メインストリーム(Mainstream):OpenAI、Anthropic、Google Gemini、Azure OpenAI、AWS Bedrock、OpenRouter。
- 中国(China):DeepSeek、通義千問、智譜 GLM、Kimi(Moonshot AI)、豆包・火山、文心一言、混元、MiniMax、零一万物、階躍星辰。このうち通義千問、智譜 GLM、Kimi、豆包・火山、混元、MiniMax、階躍星辰などは中国国内 / グローバルの 2 リージョンエンドポイントの切り替えに対応しています。
- ローカル(Local):Ollama(デフォルト
127.0.0.1:11434)、LM Studio(デフォルト127.0.0.1:1234)。 - カスタム(Custom):OpenAI Compatible(任意の OpenAI 互換サービス)、Custom(完全カスタム)。
追加と設定の完全な手順はチャネルの管理を参照してください。
前提条件
- macOS または Windows に ServBay がインストールされ、実行されていること。
- AI ゲートウェイは ServBay の付加価値機能です。チャネル / キーを追加する前に ServBay アカウントにログインしておく必要があります。未ログインの場合、画面がログインへと案内します。
TIP
AI ゲートウェイは ServBay for macOS と ServBay for Windows で機能は同一です。プロキシポート(11580)、管理ポート(11581)、および引き継ぎ対象ツールの設定ファイルパスも同じです。ドキュメント内でプラットフォームごとの差異がある場合は個別に説明します。
アカウントとプラン
AI ゲートウェイの一部の機能は ServBay アカウントのプランに関連しています:
- チャネル数 / キー数の上限 — 無料プランと有料プランでは、作成できるチャネル数、仮想キー数が異なります。上限に達すると画面でアップグレードが促されます。
- クォータと予算管理 — クォータ(Token / リクエスト数 / 金額)による制限と予算ダッシュボードは VIP / 有料機能です。未購読の場合、該当エリアはロックされ、アップグレードが促されます。
プランの詳細については、ServBay Pro と ServBay Team を参照してください。
サブスクリプションアカウントとクォータの追跡
AI ゲートウェイはサブスクリプション型プロバイダーアカウント(OAuth 認証で連携する Claude Pro / Max など)のバインドをサポートし、各プロバイダーの Web コンソールにログインすることなく、ローカルゲートウェイ内でこれらのサブスクリプションリソースを直接確認・管理できます。
サブスクリプションアカウントでできること
- プラン情報がひと目でわかる — サブスクリプションプラン名、課金体系、有効期限を表示します。
- 利用可能なエンドポイントと出力制限 — そのサブスクリプションアカウントで呼び出せるエンドポイントの一覧と、各モデルの最大出力長制限を確認できます。
- 複数ウィンドウのクォータ追跡 — 使用済み / 残りのクォータ割合、現在枯渇しているかどうか、クォータのリセット時間を視覚的に表示し、サブスクリプションリソースの適切な配分を支援します。
- 認証情報の失効を可視化 — サブスクリプションアカウントの認証情報が期限切れまたは失効した場合、画面上に明確に表示され、再認証を促します。
実験的機能
サブスクリプションアカウントの OAuth 認証連携は現在実験的機能であり、対応プロバイダーは順次拡大していきます。認証時にはブラウザでプロバイダーの OAuth フローを完了する必要があり、認証トークンはローカルにのみ保存されます。
データの保存
- チャネル設定、仮想キー、使用量統計などのデータは、ゲートウェイのバックエンドサービスがローカルで管理します。
- 仮想キーの平文は作成時(またはローテーション時)に一度だけ表示されます。その後ゲートウェイは識別用にプレフィックスのみを保持します。作成時に必ずすぐコピーして保存してください。
- 各ツールをワンクリックで引き継ぐ際、ゲートウェイはまず対象ツールの元の設定ファイルを
.bak拡張子でバックアップし、その後にローカルゲートウェイを指す設定を書き込みます。これによりいつでも復元できます。
典型的な使用フロー
- ServBay アカウントにログインし、AI ゲートウェイに入ります。
- チャネルページで少なくとも 1 つのプロバイダーチャネル(OpenAI や DeepSeek など)を追加し、実際の API Key を入力して接続をテストします。
- 仮想キーページで仮想キーを作成し、必要に応じて利用可能なモデル / チャネルとレートを制限します。
- エンドポイントページで仮想キーをアプリケーションに入力するか、同ページのワンクリック引き継ぎでよく使う AI コーディングツールを設定します。
- 統計とモニタリングページで使用量、コスト、レイテンシを確認し、必要に応じて予算を設定します。
まとめ
ServBay AI ゲートウェイは、「複数のプロバイダー、複数のキー、複数のツール」という断片化した AI 開発の現状を、「1 つのローカルエントリ、1 セットの仮想キー、1 か所の使用量ビュー」に集約します。ローカルで安全に AI 機能を集中管理し、コストを正確に把握し、最小限の手間で各種 AI コーディングツールを統合ゲートウェイに接続できるようにします。これは ServBay の AI ネイティブ開発に向けた中核機能の 1 つです。
