ServBay AI 게이트웨이(AI Gateway) 소개
ServBay AI 게이트웨이(AI Gateway)는 ServBay에 내장된 로컬 통합 AI 공급자 게이트웨이입니다. 사용자 머신에서 프록시 엔드포인트를 실행하여 각 대규모 모델 공급자(OpenAI, Anthropic, DeepSeek, Qwen 등 약 20개)로 향하는 요청을 하나의 진입점으로 통합합니다. 이를 통해 키를 중앙 관리하고 사용량과 비용을 집계하며, Claude Code, Codex 등 AI 코딩 도구를 원클릭으로 로컬 게이트웨이에 연결할 수 있습니다.
이 문서에서는 AI 게이트웨이가 무엇인지, 어떤 문제를 해결하는지, 그리고 전체 아키텍처를 소개합니다. 구체적인 작업은 다음 문서를 참고하세요.
- 채널 관리 — 각 공급자 추가 및 구성
- 가상 키 — 키 생성, 권한 제한, 교체 및 폐기
- AI 코딩 도구 원클릭 연동 — Claude Code 등 CLI를 게이트웨이로 지정
- 통계 및 모니터링 — 사용량, 비용 및 예산
- 엔드포인트 및 환경 변수 — 자체 코드에서 게이트웨이 호출
개요
일상적인 AI 개발에서는 여러 공급자의 API Key를 동시에 보유하고, 서로 다른 프로젝트와 도구의 구성 파일에 흩어져 있어 비용 집계도, 일괄 전환도 어렵습니다. ServBay AI 게이트웨이는 이러한 문제를 한곳으로 모읍니다.
- 하나의 진입점으로 여러 공급자 연결 — 각 채널을 구성하면 모든 요청이 로컬의
http://127.0.0.1:11580을 통해 전달되므로, 애플리케이션은 하나의 주소만 바라보면 됩니다. - 가상 키로 실제 키 대체 — 게이트웨이가 애플리케이션과 도구에 ‘가상 키’를 발급하고, 실제 공급자 API Key는 게이트웨이 측에만 보관되어 더 이상 여러 곳에 흩어지지 않습니다. 가상 키는 언제든지 권한 제한, 교체, 폐기가 가능합니다.
- 통합 사용량 및 비용 뷰 — 게이트웨이를 통과한 모든 요청이 기록되며, 요청 수, Token 사용량, 비용, 지연 시간, 멀티모달 사용량 등의 통계와 예산 관리를 제공합니다.
- 주요 AI 코딩 도구 원클릭 연동 — 구성 파일을 수동으로 수정할 필요 없이, 게이트웨이가 Claude Code, Codex, Qwen Code, Kimi CLI, CodeBuddy, opencode, Crush 등의 도구를 원클릭으로 로컬 게이트웨이에 연결합니다.
- 구독 계정 및 할당량 추적 — 구독형 공급자 계정(예: Claude Pro / Max의 OAuth 인증)을 바인딩할 수 있으며, 게이트웨이 내에서 요금제 정보, 사용 가능한 엔드포인트, 출력 길이 제한을 시각적으로 보여주고 다중 윈도우 할당량(사용 / 잔여 비율, 할당량 소진 상태, 재설정 시간)을 실시간으로 추적하여 구독 잔액을 항상 파악할 수 있습니다.
- 채널 기능 탐지 및 지능형 라우팅 — 채널을 추가하면 게이트웨이가 공급자 기능(OAuth 인증형 / 코딩 요금제형 / 티어 모델형)을 자동으로 탐지하고, 확인 후 탐지 결과에 따라 3단계 게이트웨이 매핑을 자동으로 기록하므로 모델 호환성을 수동으로 추측할 필요가 없습니다.
아키텍처 및 포트
AI 게이트웨이는 두 개의 로컬 서비스로 구성되며, 모두 루프백 주소(127.0.0.1)만 수신 대기합니다.
| 포트 | 용도 | 설명 |
|---|---|---|
11580 | 프록시 포트 | 애플리케이션을 위한 통합 진입점입니다. 코드와 연동된 AI 도구가 모두 여기로 요청을 보내며, 게이트웨이는 가상 키의 권한에 따라 해당 공급자 채널로 라우팅합니다. |
11581 | 관리 포트 | ServBay 애플리케이션이 내부에서 채널, 키, 통계 데이터를 관리하는 데 사용하며, 일반적으로 직접 접근할 필요가 없습니다. |
프록시 포트는 여러 호환 형식의 엔드포인트(OpenAI 호환, Anthropic 호환, Gemini 호환)를 함께 제공합니다. 자세한 내용은 엔드포인트 및 환경 변수를 참고하세요.
지원하는 공급자 채널
AI 게이트웨이에는 약 20개의 공급자 프리셋이 내장되어 있으며, 범주별로 그룹화되어 있어 채널을 추가할 때 바로 선택할 수 있습니다.
- 주요(Mainstream): OpenAI, Anthropic, Google Gemini, Azure OpenAI, AWS Bedrock, OpenRouter.
- 중국(China): DeepSeek, Qwen, Zhipu GLM, Kimi(Moonshot AI), Doubao·Volcano, Wenxin Yiyan, Hunyuan, MiniMax, 01.AI, StepFun. 이 중 Qwen, Zhipu GLM, Kimi, Doubao·Volcano, Hunyuan, MiniMax, StepFun 등은 중국 내 / 글로벌 이중 리전 엔드포인트 전환을 지원합니다.
- 로컬(Local): Ollama(기본
127.0.0.1:11434), LM Studio(기본127.0.0.1:1234). - 사용자 정의(Custom): OpenAI Compatible(모든 OpenAI 호환 서비스), Custom(완전 사용자 정의).
전체 추가 및 구성 절차는 채널 관리를 참고하세요.
전제 조건
- macOS 또는 Windows에 ServBay가 설치되어 실행 중이어야 합니다.
- AI 게이트웨이는 ServBay의 부가 기능이므로 채널 / 키를 추가하기 전에 ServBay 계정에 로그인해야 합니다. 로그인하지 않은 경우 UI에서 로그인 절차를 안내합니다.
TIP
AI 게이트웨이는 ServBay for macOS와 ServBay for Windows에서 기능이 동일하며, 프록시 포트(11580), 관리 포트(11581) 및 연동된 도구의 구성 파일 경로도 모두 같습니다. 문서에서 플랫폼 차이가 있는 경우 별도로 설명합니다.
계정 및 요금제
AI 게이트웨이의 일부 기능은 ServBay 계정 요금제와 연관됩니다.
- 채널 수 / 키 수 상한 — 무료와 유료 요금제에서 생성할 수 있는 채널, 가상 키 수가 다릅니다. 상한에 도달하면 UI에서 업그레이드를 안내합니다.
- 할당량 및 예산 관리 — 할당량(Token / 요청 수 / 금액) 제한 및 예산 대시보드는 VIP / 유료 기능이며, 구독하지 않은 경우 해당 영역이 잠기고 업그레이드를 안내합니다.
요금제 상세 내용은 ServBay Pro 및 ServBay Team을 참고하세요.
구독 계정 및 할당량 추적
AI 게이트웨이는 구독형 공급자 계정(예: OAuth 인증으로 연결된 Claude Pro / Max 등)을 바인딩할 수 있어, 각 공급자의 웹 콘솔에 로그인하지 않고도 로컬 게이트웨이에서 이러한 구독 리소스를 직접 확인하고 관리할 수 있습니다.
구독 계정으로 할 수 있는 일
- 요금제 정보를 한눈에 — 구독 요금제 이름, 과금 구조, 유효 기간을 표시합니다.
- 사용 가능한 엔드포인트 및 출력 제한 — 해당 구독 계정으로 호출할 수 있는 엔드포인트 목록과 각 모델의 최대 출력 길이 제한을 확인합니다.
- 다중 윈도우 할당량 추적 — 사용 / 잔여 할당량 비율, 현재 소진 여부, 할당량 재설정 시간을 시각적으로 보여주어 구독 리소스를 합리적으로 배분할 수 있도록 돕습니다.
- 자격 증명 만료 확인 — 구독 계정의 인증 자격 증명이 만료되거나 무효화되면 UI에 명확히 표시하여 재인증을 안내합니다.
실험적 기능
구독 계정의 OAuth 인증 연결은 현재 실험적 기능이며, 지원하는 공급자는 점차 확대될 예정입니다. 인증 시 브라우저에서 공급자의 OAuth 흐름을 완료해야 하며, 인증 토큰은 로컬에만 저장됩니다.
데이터 저장
- 채널 구성, 가상 키, 사용량 통계 등의 데이터는 게이트웨이 백엔드 서비스에서 로컬로 유지 관리합니다.
- 가상 키의 평문은 생성(또는 교체) 시 한 번만 표시되며, 이후 게이트웨이는 식별을 위해 접두사만 보관합니다. 생성 시 즉시 복사하여 저장하세요.
- 각 도구를 원클릭으로 연동할 때 게이트웨이는 대상 도구의 기존 구성 파일을
.bak확장자로 백업한 후 로컬 게이트웨이를 가리키는 구성을 기록하므로 언제든 복원할 수 있습니다.
일반적인 사용 흐름
- ServBay 계정에 로그인한 후 AI 게이트웨이로 들어갑니다.
- 채널 페이지에서 최소 하나의 공급자 채널(예: OpenAI 또는 DeepSeek)을 추가하고, 실제 API Key를 입력한 뒤 연결을 테스트합니다.
- 가상 키 페이지에서 가상 키를 생성하고, 필요에 따라 사용 가능한 모델 / 채널과 속도를 제한합니다.
- 엔드포인트 페이지에서 가상 키를 애플리케이션에 입력하거나, 같은 페이지에서 원클릭 연동으로 자주 사용하는 AI 코딩 도구를 연결합니다.
- 통계 및 모니터링 페이지에서 사용량, 비용, 지연 시간을 확인하고 필요 시 예산을 설정합니다.
요약
ServBay AI 게이트웨이는 ‘여러 공급자, 여러 키, 여러 도구’로 파편화된 AI 개발 현황을 ‘하나의 로컬 진입점, 하나의 가상 키 세트, 한곳의 사용량 뷰’로 통합합니다. 이를 통해 로컬에서 안전하게 AI 역량을 중앙 관리하고 비용을 정확히 파악하며, 최소한의 비용으로 다양한 AI 코딩 도구를 통합 게이트웨이에 연결할 수 있습니다. 이는 ServBay가 AI-native 개발을 위해 제공하는 핵심 기능 중 하나입니다.
