Routage et sélection de modèles : la relation entre canaux, modèles et clients
Lorsqu'on utilise une passerelle IA, les trois concepts les plus source de confusion sont : canal, modèle et client. Comprendre leur relation vous aidera à configurer correctement le routage et à éviter des interrogations du type « pourquoi ma requête n'a-t-elle pas emprunté le canal que j'attendais ».
Trois concepts fondamentaux
- Un canal est une connexion amont : une instance Ollama, ou un compte de fournisseur cloud.
- Un modèle est une capacité proposée sur un canal : par exemple
qwen3:8b, un nom de modèle précis. - Un client est l'outil IA que vous utilisez au quotidien : Claude Code, Codex, opencode, etc.
Leur relation forme une chaîne unidirectionnelle :
Client → (clé virtuelle) → Passerelle (stratégie de routage) → Canal → Modèle
À chaque requête, le client spécifie le nom du modèle dans la requête ; la passerelle se sert de ce nom pour trouver le canal capable de le servir, puis lui transmet la requête.
Que signifie « model (nom du canal) » dans la liste des modèles
Dans le sélecteur de modèles de clients comme Claude Code ou opencode, vous verrez des entrées telles que qwen3:8b (Ollama Qwen3). Le nom entre parenthèses indique le canal d'origine de ce modèle, et non « une autre connexion » :
- Il n'existe toujours qu'une seule connexion entre votre client et la passerelle (une adresse + une clé virtuelle).
- Un même modèle peut être configuré sur plusieurs canaux. Dans ce cas, le sélecteur n'affiche toujours qu'une seule ligne (avec, entre parenthèses, l'un des canaux d'origine) ; le canal qui sert réellement chaque requête est déterminé par la stratégie de routage (voir ci-dessous).
Les trois modes de routage : Fixed, Failover, Balanced
La stratégie de routage répond à la question suivante : lorsque plusieurs canaux peuvent servir le même modèle, lequel utiliser ?
| Mode | Comportement | Cas d'usage |
|---|---|---|
| Fixed (fixe) | Utilise toujours le même canal | Qualité de canal stable, besoin de verrouiller la source |
| Failover (principal/de secours) | En cas d'échec ou de quota épuisé du canal principal, bascule dans l'ordre vers les canaux de secours | Configurations avec un canal principal et des canaux de secours |
| Balanced (équilibré) | Répartit les requêtes à tour de rôle entre les canaux disponibles | Répartition de charge entre plusieurs canaux homogènes |
Deux points essentiels à retenir :
- Le routage bascule uniquement entre canaux, jamais entre modèles. Le modèle de la requête est toujours décidé par votre client ; la passerelle ne change pas de modèle à votre place.
- Des modèles différents empruntent naturellement leurs canaux respectifs. Balanced ne fait pas « le modèle du canal A cette fois-ci, celui du canal B la fois suivante » — il alterne uniquement entre les canaux d'un même modèle.
Le modèle est décidé par le client : comment changer de modèle
La passerelle se contente de transmettre : votre outil inclut le nom du modèle dans chaque requête, et la passerelle suit le routage. Le changement de modèle s'effectue dans le client :
- opencode : saisissez
/modelsdans le TUI pour choisir ; ou configurezmodel(modèle principal) etsmall_model(tâches légères comme la génération de titres) dansopencode.json. - Claude Code : utilisez la commande
/modelpour basculer. - Codex : spécifiez via le paramètre
-m <model>ou le fichier de configuration.
Connecter vos outils quotidiens à la passerelle en toute sécurité
Vous craignez de perturber votre usage quotidien ? Suivez cette procédure :
- Testez d'abord sur un projet secondaire : effectuez la connexion en un clic dans le répertoire d'un projet non critique, et vérifiez que votre flux de travail fonctionne normalement.
- Validez avec une requête : envoyez une requête de test, puis consultez la page « Historique d'utilisation » pour voir sur quel modèle et quel canal elle a abouti, et à quel coût.
- Revenez en arrière à tout moment : arrêtez la prise en charge dans la page « Gestion de l'intégration ». Après l'arrêt : les configurations écrites par ServBay seront supprimées et la clé virtuelle créée pour la prise en charge sera révoquée ; vos configurations personnalisées antérieures ne seront pas automatiquement restaurées — ajustez-les manuellement si nécessaire, puis redémarrez le client pour que les changements prennent effet.
Résumé
- Canal = connexion amont ; modèle = capacité sur un canal ; le nom du modèle est spécifié par le client à chaque requête.
- La stratégie de routage choisit uniquement entre « plusieurs canaux d'un même modèle » : Fixed fixe, Failover principal/de secours, Balanced en alternance.
- Changez de modèle dans le sélecteur de votre client ; vérifiez l'attribution et le coût de chaque requête dans la page « Historique d'utilisation ».
