Enrutamiento y selección de modelos: la relación entre canales, modelos y clientes
Al usar un gateway de IA, es fácil confundir tres conceptos: canales, modelos y clientes. Comprender su relación te ayudará a configurar correctamente el enrutamiento y a evitar confusiones del tipo «¿por qué mi solicitud no pasó por el canal que esperaba?».
Tres conceptos básicos
- Un canal es una conexión ascendente (upstream): una instancia de Ollama o una cuenta de un proveedor de servicios en la nube.
- Un modelo es una capacidad disponible en un canal: por ejemplo, un nombre de modelo concreto como
qwen3:8b. - Un cliente es la herramienta de IA que usas a diario: Claude Code, Codex, opencode, etc.
Su relación forma una cadena unidireccional:
Cliente → (clave virtual) → Gateway (política de enrutamiento) → Canal → Modelo
En cada solicitud, el cliente especifica el nombre del modelo; el gateway, a partir de ese nombre, encuentra el canal que puede atenderlo y le reenvía la solicitud.
Qué significa «model (nombre del canal)» en la lista de modelos
En el selector de modelos de clientes como Claude Code u opencode verás entradas como qwen3:8b (Ollama Qwen3). El nombre entre paréntesis indica el canal de origen de ese modelo, no «otra conexión»:
- Entre tu cliente y el gateway siempre hay una sola conexión (una dirección + una clave virtual).
- Un mismo modelo puede estar configurado en varios canales. En ese caso, el selector sigue mostrando una sola línea (con uno de los canales de origen entre paréntesis); qué canal atiende realmente cada solicitud lo decide la política de enrutamiento (ver más abajo).
Tres modos de enrutamiento: Fixed, Failover y Balanced
La pregunta que responde la política de enrutamiento es: cuando un mismo modelo puede ser atendido por varios canales, ¿cuál se utiliza?
| Modo | Comportamiento | Escenarios adecuados |
|---|---|---|
| Fixed (fijo) | Utiliza siempre el mismo canal | Calidad estable del canal, cuando se quiere fijar el origen |
| Failover (principal/respaldo) | Si el canal principal falla o se queda sin cuota, cambia en orden a los canales de respaldo | Configuraciones con canal principal y de respaldo |
| Balanced (equilibrado) | Reparte las solicitudes de forma rotativa entre los canales disponibles | Repartir la carga entre varios canales homogéneos |
Dos límites importantes:
- El enrutamiento solo cambia entre canales, no entre modelos. Qué modelo se solicita siempre lo decide tu cliente; el gateway no cambia el modelo por ti.
- Los modelos diferentes ya van cada uno por su propio canal. Balanced no hace «ahora uso el modelo del canal A, luego el del canal B»: solo rota entre los canales de un mismo modelo.
El modelo lo decide el cliente: cómo cambiar de modelo
El gateway solo se encarga de reenviar: tu herramienta incluye el nombre del modelo en cada solicitud y el gateway lo enruta en consecuencia. El cambio de modelo se realiza en el cliente:
- opencode: escribe
/modelsen la TUI para seleccionar; o configuramodel(modelo principal) ysmall_model(para tareas ligeras como la generación de títulos) enopencode.json. - Claude Code: cambia con el comando
/model. - Codex: especifícalo con el parámetro
-m <model>o en el archivo de configuración.
Conecta tus herramientas cotidianas al gateway de forma segura
¿Te preocupa afectar tu uso diario? Sigue este proceso:
- Prueba primero con un proyecto secundario: completa la conexión con un clic en el directorio de un proyecto poco importante y verifica que el flujo de trabajo funciona con normalidad.
- Verifica con una solicitud: envía una solicitud de prueba y consulta la página «Historial de uso» para ver en qué modelo y en qué canal cayó, y cuánto costó.
- Vuelve atrás en cualquier momento: detén la toma de control en la página «Gestión de conexiones». Al detenerla: la configuración escrita por ServBay se elimina y las claves virtuales creadas por la toma de control se revocan; tus configuraciones personalizadas anteriores no se restauran automáticamente, ajústalas manualmente si lo necesitas y reinicia el cliente para que los cambios surtan efecto.
Resumen
- Canal = conexión ascendente; modelo = capacidad del canal; el nombre del modelo lo especifica el cliente en cada solicitud.
- La política de enrutamiento solo elige entre «los canales de un mismo modelo»: Fixed fija, Failover alterna entre principal y respaldo, Balanced rota.
- Cambia de modelo en el selector de modelos del cliente; verifica la procedencia y el coste de cada solicitud en la página «Historial de uso».
