AI गेटवे में चैनल प्रबंधित करें
「चैनल (Channel)」 AI गेटवे में किसी प्रदाता के एक्सेस पॉइंट का कॉन्फ़िगरेशन है — इसमें उस प्रदाता का पता, असली API Key, उपलब्ध मॉडल, तथा मूल्य निर्धारण और कोटा जैसी जानकारी संग्रहित रहती है। गेटवे इन्हीं चैनलों के आधार पर ऐप से आने वाली रिक्वेस्ट को संबंधित प्रदाता तक रूट करता है। यह लेख बताता है कि चैनल कैसे जोड़ें, कॉन्फ़िगर करें, परखें और प्रबंधित करें।
पूर्वापेक्षाएँ
- ServBay इंस्टॉल और चल रहा हो, तथा ServBay अकाउंट में लॉगिन हो (चैनल जोड़ने से पहले लॉगिन आवश्यक है)।
- लक्ष्य प्रदाता की असली API Key तैयार हो (स्थानीय प्रदाताओं जैसे Ollama / LM Studio के लिए भरना ज़रूरी नहीं)।
- यदि AI गेटवे की समग्र संरचना से परिचित नहीं हैं, तो पहले AI गेटवे परिचय पढ़ लें।
चैनल जोड़ें
AI गेटवे → चैनल (Channels) पेज पर जाएँ और जोड़ें (Add) पर क्लिक करके विज़ार्ड खोलें। विज़ार्ड तीन चरणों में बँटा है।
चरण 1: प्रदाता चुनें
प्रदाता श्रेणियों में समूहित करके दिखाए जाते हैं; चुनने के लिए कार्ड पर क्लिक करें:
- मुख्यधारा (Mainstream): OpenAI, Anthropic, Google Gemini, Azure OpenAI, AWS Bedrock, OpenRouter.
- चीन (China): DeepSeek, Qwen, Zhipu GLM, Kimi, Doubao·Volcano, ERNIE Bot, Hunyuan, MiniMax, 01.AI, StepFun.
- स्थानीय (Local): Ollama, LM Studio.
- कस्टम (Custom): OpenAI Compatible, Custom.
प्रदाता चुनने के बाद गेटवे उस प्रदाता का डिफ़ॉल्ट Base URL स्वतः भर देता है।
दो-क्षेत्रीय स्विचिंग
Qwen, Zhipu GLM, Kimi, Doubao·Volcano, Hunyuan, MiniMax, StepFun जैसे चीनी प्रदाता एक साथ घरेलू और वैश्विक दोनों एंडपॉइंट उपलब्ध कराते हैं। ऐसे प्रदाता चुनते समय विज़ार्ड में "क्षेत्र" चयनकर्ता (🇨🇳 घरेलू / 🌐 वैश्विक) दिखाई देता है; स्विच करने पर Base URL स्वतः संबंधित क्षेत्र के पते में अपडेट हो जाता है।
चरण 2: कॉन्फ़िगरेशन भरें
- चैनल का नाम (आवश्यक) — सूची में इस चैनल की पहचान के लिए; आप इसे अपनी इच्छा से रख सकते हैं।
- Base URL (आवश्यक) — प्रदाता का API पता। अधिकांश प्रदाताओं के लिए यह स्वतः भर दिया जाता है; Azure OpenAI और Custom में इसे आपको स्वयं भरना होगा।
- API Key (वैकल्पिक) — प्रदाता की असली कुंजी। खाली छोड़ने पर केवल यह परखा जा सकेगा कि एंडपॉइंट पहुँच योग्य है या नहीं, कुंजी की वैधता सत्यापित नहीं हो सकेगी; स्थानीय प्रदाताओं (Ollama / LM Studio) के लिए सामान्यतः भरने की ज़रूरत नहीं होती।
- मॉडल — दो तरीके हैं, इनमें से एक चुनें:
- स्वचालित खोज: खोज पर क्लिक करने पर गेटवे प्रदाता के मॉडल-सूची API को कॉल करके उपलब्ध मॉडल ले आता है, और आप चिप के रूप में अनेक चुन सकते हैं।
- मैन्युअल रूप से भरें: सीधे मॉडल का नाम दर्ज करें। Azure चैनल में मॉडल नाम के बजाय डिप्लॉयमेंट नाम (Deployment name) भरना होता है।
- प्राथमिकता / वेट — जब एक ही मॉडल के लिए कई चैनल सेवा दे सकते हैं, तो गेटवे इसी के आधार पर रूटिंग और लोड वितरण तय करता है।
Azure OpenAI पर ध्यान दें
Azure चैनल के "मॉडल" फ़ील्ड में आपके द्वारा Azure पोर्टल में बनाया गया डिप्लॉयमेंट नाम (Deployment name) भरना चाहिए, न कि अंतर्निहित मॉडल का नाम। Base URL में भी आपके Azure रिसोर्स का एंडपॉइंट भरना होगा।
चरण 3: पुष्टि करें और सबमिट करें
कॉन्फ़िगरेशन सारांश जाँचने के बाद सबमिट करें। सबमिट सफल होने पर नया चैनल चैनल सूची में दिखाई देगा और रीयल-टाइम हेल्थ स्टेटस दिखाएगा।
क्षमता प्रोबिंग और रूटिंग रणनीति
चैनल जोड़ने के बाद गेटवे उस चैनल पर क्षमता प्रोबिंग (capability probing) करता है — यह AI गेटवे का सबसे केंद्रीय स्मार्ट रूटिंग तंत्र है। प्रोबिंग के नतीजे तय करते हैं कि Claude Code जैसे टूल सीधे इस्तेमाल हो सकते हैं या मॉडल मैपिंग बनानी पड़ेगी, और लक्ष्य मॉडल कैसे चुना जाएगा।
प्रोबिंग के दो प्रमुख संकेतक
गेटवे हर चैनल पर दो मुख्य तथ्य परखता है (दोनों त्रि-अवस्थीय: true / false / अपरखा हुआ):
| प्रोबिंग आइटम | अर्थ | true | false | अपरखा हुआ |
|---|---|---|---|---|
Claude मॉडल नाम स्वीकारता (accepts_claude_names) | क्या चैनल मूल रूप से claude-opus-* / claude-sonnet-* / claude-haiku-* जैसे मॉडल नाम पहचानता है | सीधे कनेक्ट करें, मैपिंग की ज़रूरत नहीं | नहीं पहचानता; claude-* नामों को अपस्ट्रीम के असली मॉडल नाम में बदलने के लिए मैपिंग बनाना अनिवार्य | प्रोबिंग नहीं चली या असफल रही, निष्कर्ष नहीं निकाला जा सकता |
टियर-आधारित भेद (tier_aware) | क्या अपस्ट्रीम स्वयं opus / sonnet / haiku टियर के अनुसार अलग मॉडल लौटाता है | अपस्ट्रीम में टियर पहले से विभाजित हैं, उसे ही संभालने दें | टियर में भेद नहीं (सभी टियर के लिए एक ही मॉडल), गेटवे को मैपिंग बनानी होगी | पता नहीं चल सका या प्रोबिंग नहीं हुई |
अनुमान क्यों नहीं, प्रोबिंग क्यों
अलग-अलग प्रदाताओं का व्यवहार काफ़ी भिन्न होता है। OpenAI मूल रूप से claude-* मॉडल नाम नहीं पहचानता; कुछ रीसेलर प्रदाता फ़ॉरवर्डिंग के ज़रिए इन्हें पहचान लेते हैं; जबकि कोडिंग-सब्सक्रिप्शन प्रकार के प्रदाता (जैसे Claude Pro/Max सदस्यता) केवल सदस्यता से बँधे विशिष्ट मॉडल नाम ही पहचान सकते हैं। गेटवे चैनल के प्रकार से अंदाज़ा नहीं लगाता, बल्कि वास्तविक प्रोबिंग के बाद रूटिंग रणनीति तय करता है।
रूटिंग निर्धारण: पाँच स्थितियाँ
जब आप AI Gateway → एक्सेस प्रबंधन → क्लाइंट पेज पर Claude Code के लिए "वन-क्लिक टेकओवर" करते हैं, तो गेटवे सभी संभावित चैनलों के प्रोबिंग नतीजों को समेटकर एक रूटिंग निर्धारण निकालता है:
| संभावित चैनल की स्थिति | निर्धारण | अर्थ |
|---|---|---|
| कोई उपयोगी संभावित चैनल नहीं (कोई चैनल नहीं / सभी अस्वस्थ / वर्चुअल की के स्कोप में कोई चैनल नहीं) | कोई संभावित चैनल नहीं | पहले चैनल जोड़ना या ठीक करना होगा |
| किसी भी संभावित चैनल का प्रोबिंग मान अपरखा हुआ | अपरीक्षित | पहले एक बार प्रोबिंग चलानी होगी; बिना सत्यापन के मैपिंग नहीं बनाई जा सकती |
| सभी संभावित चैनल claude मॉडल नाम पहचानते हैं | सीधा कनेक्शन | मैपिंग नहीं बनेगी, रिक्वेस्ट जैसी है वैसी फ़ॉरवर्ड होगी |
| सभी संभावित चैनल claude मॉडल नाम नहीं पहचानते | मैपिंग अनिवार्य | गेटवे तीन-टियर मैपिंग बनाता है, claude-* को अपस्ट्रीम के असली मॉडल नाम में बदलता है |
| संभावित चैनलों में कुछ पहचानते हैं, कुछ नहीं | मिश्रित | मानवीय निर्णय आवश्यक (पहचानने वाले सीधे जाएँ, न पहचानने वाले मैपिंग से) |
मॉडल मैपिंग: claude-* को अपस्ट्रीम के असली मॉडल में बदलना
जब निर्धारण "मैपिंग अनिवार्य" होता है, तो गेटवे Claude Code के लिए तीन मॉडल मैपिंग नियम बनाता है, जो तीनों टियर कवर करते हैं:
| Claude Code द्वारा भेजा गया मॉडल नाम | मैपिंग नियम (वाइल्डकार्ड) | मैप होकर बनता है |
|---|---|---|
claude-opus-* | सभी opus टियर रिक्वेस्ट से मेल | संभावित चैनलों का फ्लैगशिप मॉडल |
claude-sonnet-* | सभी sonnet टियर रिक्वेस्ट से मेल | संभावित चैनलों का फ्लैगशिप मॉडल या मानक मॉडल |
claude-haiku-* | सभी haiku टियर रिक्वेस्ट से मेल | संभावित चैनलों का हल्का मॉडल |
लक्ष्य मॉडल चुनने के नियम (प्राथमिकता के क्रम में फ़ॉलबैक):
- फ़ैमिली प्रीसेट: यदि संभावित मॉडलों में किसी ज्ञात फ़ैमिली का कीवर्ड दिखे (जैसे
glm), तो सीधे उस फ़ैमिली का फ्लैगशिप (जैसेglm-5.2) opus/sonnet टियर के लक्ष्य के रूप में लें, और उसी फ़ैमिली का हल्का संस्करण (जैसेglm-4.7-flash) haiku टियर के लक्ष्य के रूप में लें। - कीवर्ड मिलान: फ़ैमिली प्रीसेट न होने पर opus/sonnet के लिए संभावित सूची का पहला मॉडल लें; haiku के लिए संभावित सूची में हल्के कीवर्ड (
flash/mini/lite/air/small/turbo/haiku) से मेल खाने वाला पहला मॉडल लें। - अंतिम उपाय: फिर भी कुछ न मिले तो तीनों टियर के लिए संभावित सूची का पहला मॉडल लें।
haiku टियर में गलती की कीमत सबसे ज़्यादा
Claude Code में haiku टियर के कॉल सबसे अधिक होते हैं (हर संवाद के हल्के कॉल इसी का उपयोग करते हैं)। अगर गलती से haiku टियर में फ्लैगशिप मॉडल भर दिया जाए, तो बिल कई गुना बढ़ सकता है। गेटवे की कीवर्ड मिलान तालिका 7 हल्के सफ़िक्स (flash / mini / lite / air / small / turbo / haiku) कवर करती है, जिससे भारी मॉडल haiku टियर में भरने की गलती नहीं होती।
मैपिंग लिखे जाने का तंत्र
टेकओवर की पुष्टि के बाद गेटवे /admin/model-mappings API के ज़रिए मैपिंग रिकॉर्ड लिखता है। प्रत्येक मैपिंग रिकॉर्ड में शामिल होता है:
- स्रोत प्रोटोकॉल (
source_protocol):anthropic(Claude Code द्वारा भेजी गई रिक्वेस्ट Anthropic प्रारूप में होती है) - स्रोत मॉडल मिलान (
source_model_pattern): वाइल्डकार्ड, जैसेclaude-opus-* - लक्ष्य प्रोटोकॉल (
target_protocol):openai(सब कुछ एकरूप करके OpenAI प्रारूप में अपस्ट्रीम को भेजा जाता है) - लक्ष्य मॉडल (
target_model): प्रोबिंग से चुना गया विशिष्ट मॉडल नाम
लिखना आइडेम्पोटेंट है — बार-बार टेकओवर करने पर डुप्लिकेट मैपिंग नहीं बनती; लिखने से पहले मौजूदा मैपिंग सूची लाकर तुलना की जाती है।
रनटाइम रूटिंग नियम: failover और डिग्रेडेशन
टेकओवर के समय लिखी जाने वाली स्थिर मैपिंग के अलावा, गेटवे रनटाइम रूटिंग नियमों (routing rules) का भी समर्थन करता है, जो रिक्वेस्ट गेटवे से गुज़रते समय गतिशील निर्णय लेते हैं:
| नियम फ़ील्ड | कार्य |
|---|---|
ट्रिगर शर्त (condition_type) | डिग्रेडेशन कब ट्रिगर हो, जैसे चैनल का कोटा समाप्त होना (quota_exhausted) |
लागत सीमा (cost_threshold_usd) | वैकल्पिक: जब उस चैनल की संचित लागत सीमा से अधिक हो जाए तो ट्रिगर हो |
क्रिया (action_type) | ट्रिगर होने पर क्या करें, जैसे निर्दिष्ट बैकअप चैनल पर स्विच करना (switch_to) |
लक्ष्य चैनल (target_channel_id) | किस बैकअप चैनल पर डिग्रेड करना है |
लक्ष्य मॉडल (target_model) | वैकल्पिक: बैकअप चैनल पर डिग्रेड करते समय मॉडल भी बदलें |
कई रूटिंग नियमों को मिलाकर आप यह कर सकते हैं: जब चैनल A की सदस्यता कोटा समाप्त हो जाए तो स्वतः चैनल B के पे-एज़-यू-गो एंडपॉइंट पर स्विच हो जाना; जब किसी चैनल की 24 घंटे की लागत सीमा पार हो जाए तो सस्ते मॉडल पर डिग्रेड कर देना।
लोड बैलेंसिंग और प्राथमिकता
जब एक ही मॉडल के लिए कई स्वस्थ चैनल सेवा दे सकते हैं, तो गेटवे इस रणनीति से चुनता है:
- प्राथमिकता मोड (डिफ़ॉल्ट): केवल सर्वोच्च प्राथमिकता वाला चैनल लिया जाता है; समान प्राथमिकता वाले चैनलों में गेटवे आंतरिक वेट के अनुसार वितरित करता है।
- राउंड-रॉबिन मोड (
round_robin): सभी स्वस्थ संभावित चैनलों में बारी-बारी से रिक्वेस्ट बाँटी जाती हैं।
प्राथमिकता चैनल कॉन्फ़िगरेशन में सेट की जाती है (संख्या जितनी बड़ी, प्राथमिकता उतनी ऊँची), और वर्चुअल की का allowed_channels उपलब्ध चैनलों का दायरा सीमित करता है।
कनेक्टिविटी परीक्षण
चैनल सूची में किसी एक चैनल पर कनेक्टिविटी परीक्षण चलाया जा सकता है। परीक्षण दो आयामों में होता है:
- एंडपॉइंट पहुँच (reachable) — जाँचता है कि Base URL से कनेक्ट हो पाता है या नहीं (नेटवर्क और पता सही हैं या नहीं)।
- कुंजी की वैधता (authenticated) — वास्तव में प्रदाता के इंटरफ़ेस को कॉल करके सत्यापित करता है कि API Key वैध है या नहीं। यह केवल तभी जाँचा जाता है जब API Key भरी गई हो।
परीक्षण परिणाम में दिखेगा: राउंड-ट्रिप लेटेंसी (मिलीसेकंड), स्टेटस बैज तथा त्रुटि संदेश।
TIP
जोड़ने के विज़ार्ड में, यदि एंडपॉइंट पहुँच योग्य न हो तो अगले चरण पर जाने से रोक दिया जाएगा; यदि एंडपॉइंट पहुँच योग्य है पर कुंजी अवैध है तो केवल चेतावनी मिलेगी और आप आगे बढ़ सकते हैं (जैसे आप बाद में कुंजी जोड़ने का इरादा रखते हों)।
उन्नत कॉन्फ़िगरेशन
चैनल जोड़ते या संपादित करते समय उन्नत कॉन्फ़िगरेशन खोल सकते हैं, जो लागत गणना और कोटा नियंत्रण के लिए है:
- मूल्य गुणक (Rate Multiplier) — प्रदाता की आधिकारिक कीमत पर एक गुणक लगाया जाता है, ताकि आप अपनी वास्तविक लागत या पुनर्विक्रय मूल्य के अनुसार हिसाब रख सकें; डिफ़ॉल्ट
1.0। - बिलिंग संरचना — इस चैनल की बिलिंग विधि बताती है, जैसे पे-एज़-यू-गो, सदस्यता (subscription), पैकेज (package)।
- बैलेंस — बैलेंस स्रोत स्थिर मान, OSS बिल या मैन्युअल रखरखाव में से चुन सकते हैं; OSS बिल चुनने पर बिल का प्रकार भी निर्दिष्ट कर सकते हैं। बैलेंस और अपडेट समय चैनल विवरण में केवल-पढ़ने के रूप में दिखते हैं।
- सदस्यता समाप्ति तिथि — सदस्यता / पैकेज प्रकार के चैनलों के लिए समाप्ति तिथि दर्ज की जा सकती है।
- कोटा सीमा — Token संख्या, रिक्वेस्ट संख्या या राशि के आधार पर ऊपरी सीमा तय कर सकते हैं, और अवधि (दैनिक / साप्ताहिक / मासिक / कस्टम) चुन सकते हैं। कोटा समाप्त होने पर वह चैनल स्वतः रूटिंग से बाहर हो जाता है — यह अनपेक्षित खर्च रोकने वाला सुरक्षा-वाल्व है।
चैनल संपादित करें और हटाएँ
- संपादन — चैनल सूची में किसी चैनल को खोलकर नाम, Base URL, API Key, मॉडल और उन्नत कॉन्फ़िगरेशन बदल सकते हैं।
- हटाना — चैनल हटाने के बाद उस पर निर्भर वर्चुअल की अब उस तक रूट नहीं कर पाएँगी, इसलिए सावधानी बरतें।
हेल्थ स्टेटस
चैनल सूची और अवलोकन पेज प्रत्येक चैनल का हेल्थ स्टेटस (सामान्य / डिग्रेडेड / अनुपलब्ध) रीयल-टाइम में दिखाते हैं, जिससे आप निष्क्रिय प्रदाता कॉन्फ़िगरेशन जल्दी पकड़ सकते हैं।
अक्सर पूछे जाने वाले प्रश्न (FAQ)
- प्र: चैनल जोड़ते समय लॉगिन की आवश्यकता बताई जा रही है?
- उ: AI गेटवे ServBay की वैल्यू-एडेड सुविधा है; चैनल / कुंजी जोड़ने से पहले ServBay अकाउंट में लॉगिन करना होता है, बस इंटरफ़ेस के निर्देशों का पालन करके लॉगिन कर लें।
- प्र: चैनलों की संख्या सीमा तक पहुँच गई है?
- उ: बनाए जा सकने वाले चैनलों की संख्या अकाउंट प्लान पर निर्भर करती है; सीमा तक पहुँचने पर अनुपयोगी चैनल हटा सकते हैं या प्लान अपग्रेड कर सकते हैं।
- प्र: मॉडल स्वचालित खोज से सूची नहीं आ रही?
- उ: पहले पुष्टि करें कि Base URL सही है और API Key वैध है (कनेक्टिविटी परीक्षण के "कुंजी वैधता" से सत्यापित कर सकते हैं); कुछ प्रदाता मॉडल सूची लौटाने के लिए वैध कुंजी माँगते हैं; आप मॉडल नाम मैन्युअल रूप से भरने का विकल्प भी चुन सकते हैं।
- प्र: स्थानीय Ollama / LM Studio जोड़ने के लिए Key भरनी पड़ती है?
- उ: सामान्यतः नहीं। बस सुनिश्चित करें कि संबंधित स्थानीय सेवा शुरू हो और डिफ़ॉल्ट पोर्ट पर सुन रही हो (Ollama
11434, LM Studio1234)।
- उ: सामान्यतः नहीं। बस सुनिश्चित करें कि संबंधित स्थानीय सेवा शुरू हो और डिफ़ॉल्ट पोर्ट पर सुन रही हो (Ollama
सारांश
चैनल AI गेटवे की रिक्वेस्ट रूटिंग का आधार हैं। तीन-चरणीय विज़ार्ड की मदद से आप लगभग 20 प्रदाताओं को तेज़ी से जोड़ सकते हैं; दो-क्षेत्रीय स्विचिंग, स्वचालित मॉडल खोज और दो-आयामी कनेक्टिविटी परीक्षण से कॉन्फ़िगरेशन सही होने की पुष्टि करें, और फिर मूल्य निर्धारण व कोटा जैसी उन्नत सेटिंग्स की मदद से लागत का सूक्ष्म प्रबंधन करें। चैनल कॉन्फ़िगर कर लेने के बाद, आप ऐप और टूल के उपयोग के लिए वर्चुअल की बना सकते हैं।
