Расширенные возможности

Балансировка нагрузки

Распределяйте API-трафик между несколькими моделями и провайдерами для максимальной пропускной способности, минимальной задержки и избежания узких мест — всё настраивается в панели управления.

Стратегии балансировки нагрузки

TokSpan поддерживает несколько стратегий маршрутизации, настраиваемых для каждого канала в Панели управления:

СтратегияКак работаетЛучше всего для
Взвешенный случайный выборРаспределяет запросы на основе назначенных весов (например, 70% Модель A, 30% Модель B)Постепенная миграция, A/B-тестирование, оптимизация затрат
Приоритетная (фейловер)Направляет на доступную модель с наивысшим приоритетом; при отказе переходит по цепочке внизНадёжность в продакшене, схемы основной/резервный
На основе лимитов запросовРаспределяет избыточный трафик при достижении моделью лимита запросовВысокопроизводительная пакетная обработка

Настройка балансировки нагрузки в Панели управления

  1. Войдите в Панель управления TokSpan по адресу api.tokspan.com/dashboard
  2. Перейдите в раздел Каналы в боковом меню
  3. Для взвешенного распределения: создайте несколько каналов для одной группы моделей, назначьте разные веса каждому
  4. Для приоритетного: настройте порядок приоритета моделей в рамках одного канала
  5. Сохраните конфигурацию — изменения вступают в силу немедленно, перезапуск не требуется

Пример: Взвешенное распределение между провайдерами

Чтобы разделить трафик 60/40 между двумя провайдерами для одного типа модели:

КаналМодельВесДоля
Канал AGPT-4o (OpenAI)6060% трафика
Канал BClaude Opus 4.8 (Anthropic)4040% трафика

Пользователи вызывают одно имя модели — TokSpan прозрачно обрабатывает распределение. Изменения на стороне клиента не требуются.

Совет: Начните с распределения 90/10 при тестировании нового провайдера. Постепенно увеличивайте вес по мере роста уверенности в надёжности и качестве ответов.