Funciones Avanzadas
Enrutamiento Personalizado
Controla qué modelo subyacente sirve cada solicitud usando reglas de enrutamiento a nivel de canal — configuradas en el Panel, transparentes para el código de tu aplicación.
Cómo Funciona el Enrutamiento en TokSpan
TokSpan utiliza un modelo de enrutamiento basado en canales. Cada canal mapea un nombre de modelo (lo que su app llama) a un proveedor y modelo upstream específico (lo que realmente procesa la solicitud). Al configurar canales estratégicamente, usted construye lógica de enrutamiento flexible sin modificar el código de su aplicación.
Configurando el Enrutamiento en el Panel
- Inicie sesión en el Panel de TokSpan en api.tokspan.com/dashboard
- Navegue a Canales en la barra lateral
- Cree o edite un canal para definir el mapeo de modelos
- Establezca el nombre del modelo (expuesto a sus usuarios) y el proveedor/modelo upstream (backend real)
- Configure peso, prioridad y límites de tasa por canal
- Use Grupos de Modelos para agrupar modelos relacionados bajo un nombre visible para el usuario
Patrones de Enrutamiento Comunes
Enrutamiento Optimizado por Costo
Mapee un nombre de modelo genérico como gpt-4o al proveedor más económico que lo ofrezca actualmente. Cree canales con diferentes proveedores pero el mismo nombre visible para el usuario, cada uno con pesos apropiados.
Enrutamiento por Grupo de Usuarios
Cree claves API separadas para diferentes niveles de usuario y limite cada clave a grupos de modelos específicos:
- Claves de nivel gratuito → Limitadas a modelos eficientes en costo (GPT-4o-mini, Gemini 2.5 Flash, DeepSeek V3)
- Claves de nivel Pro → Acceso a modelos premium (GPT-4o, Claude Opus, Gemini 2.5 Pro)
- Claves empresariales → Catálogo completo de modelos con límites de tasa personalizados
Enrutamiento por Capacidad
Configure grupos de modelos separados para diferentes cargas de trabajo — sus desarrolladores llaman nombres de modelo descriptivos y obtienen el backend óptimo:
coding-assistant→ Enruta a Claude Opus / GPT-4o / DeepSeek V3 (modelos optimizados para código)content-writer→ Enruta a Claude Sonnet / GPT-4o / Gemini Pro (calidad y velocidad equilibradas)data-analyst→ Enruta a los modelos con las ventanas de contexto más grandes en su grupo de proveedores