高度な機能
カスタムルーティング
チャネルレベルのルーティングルールを使用して、各リクエストを処理する基盤モデルを制御します — ダッシュボードで設定し、アプリケーションコードには透過的です。
TokSpan のルーティングの仕組み
TokSpan はチャネルベースのルーティングモデルを採用しています。各チャネルは、モデル名(アプリが呼び出す名前)を特定の上流プロバイダーとモデル(実際にリクエストを処理するもの)にマッピングします。チャネルを戦略的に設定することで、アプリケーションコードに手を加えることなく柔軟なルーティングロジックを構築できます。
ダッシュボードでのルーティング設定
- TokSpan ダッシュボード(api.tokspan.com/dashboard)にログインします
- サイドバーの Channels に移動します
- チャネルを作成または編集してモデルマッピングを定義します
- モデル名(ユーザーに公開)と上流プロバイダー/モデル(実際のバックエンド)を設定します
- チャネルごとに重み、優先度、レート制限を設定します
- モデルグループを使用して、関連モデルを1つのユーザー向け名前にまとめます
一般的なルーティングパターン
コスト最適化ルーティング
gpt-4o のような汎用モデル名を、現在最も安価に提供しているプロバイダーにマッピングします。異なるプロバイダーで同じユーザー向け名を持つチャネルを作成し、それぞれに適切な重みを設定します。
ユーザーグループルーティング
異なるユーザーティアに対して個別の API キーを作成し、各キーを特定のモデルグループにスコープします:
- 無料ティアキー → コスト効率の良いモデルにスコープ(GPT-4o-mini、Gemini 2.5 Flash、DeepSeek V3)
- Pro ティアキー → プレミアムモデルにアクセス(GPT-4o、Claude Opus、Gemini 2.5 Pro)
- エンタープライズキー → カスタムレート制限付きの全モデルカタログ
機能ベースルーティング
異なるワークロードに対して個別のモデルグループを設定します — 開発者は説明的なモデル名を呼び出すだけで最適なバックエンドが選択されます:
coding-assistant→ Claude Opus / GPT-4o / DeepSeek V3(コード最適化モデル)にルーティングcontent-writer→ Claude Sonnet / GPT-4o / Gemini Pro(品質と速度のバランス)にルーティングdata-analyst→ プロバイダープール内で最大のコンテキストウィンドウを持つモデルにルーティング
キースコーピングはユーザーティアルーティングの主要なメカニズムです。詳細な設定手順については 認証 — キースコーピング をご参照ください。