高度な機能
自動フェイルオーバー
プライマリモデルプロバイダーにダウンタイムが発生した場合、TokSpan は自動的にトラフィックをバックアップモデルにルーティングします — リクエストの損失や手動介入は一切ありません。
仕組み
TokSpan は上流プロバイダーの状態をリアルタイムで監視しています。プロバイダーが 5xx エラーを繰り返し返すか、タイムアウトしきい値を超えた場合、トラフィックは自動的にフェイルオーバーチェーン内の次のモデルにリダイレクトされます。プライマリが復旧すると、トラフィックは通常のルーティングに戻ります。
フェイルオーバーチェーンはダッシュボードでモデルごとに設定します — クライアント側でのカスタムヘッダーやコード変更は不要です。
ダッシュボードでのフェイルオーバー設定
- TokSpan ダッシュボード(api.tokspan.com/dashboard)にログインします
- サイドバーの Channels に移動します
- フェイルオーバーで保護したいモデルチャネルを選択します
- チャネル設定で Model Mapping または Priority の設定を見つけます
- 優先順位順にバックアップモデルを追加します — リスト内で最初に利用可能なモデルがトラフィックを処理します
- フェイルオーバーをトリガーするタイムアウトとリトライ回数のしきい値を設定します
- チャネル設定を保存します
耐障害性の高いフェイルオーバーチェーンの構築
本番ワークロードには、クロスプロバイダーのフェイルオーバー戦略を推奨します:
| 優先度 | モデル | プロバイダー | 役割 |
|---|---|---|---|
| 1(プライマリ) | GPT-4o | OpenAI | デフォルト — 総合的に最高品質 |
| 2(フォールバック) | Claude Sonnet 4.6 | Anthropic | OpenAI がダウンした場合に作動 |
| 3(最終手段) | Gemini 2.5 Flash | 予算に優しいセーフティネット |
プロのヒント:フェイルオーバーチェーンには、必ず異なるプロバイダーのモデルを少なくとも1つ含めてください。プロバイダーレベルの障害が最も一般的な故障モードです。クロスプロバイダーチェーン(OpenAI → Anthropic → Google)が最も強力な保護を提供します。
フェイルオーバーイベントの監視
フェイルオーバーのアクティビティは以下で追跡できます:
- ダッシュボードログ — チャネルでフィルタリングしてフェイルオーバーがトリガーされたリクエストを確認
- Webhooks —
system.incidentイベントをサブスクライブしてリアルタイムのフェイルオーバー通知を受信(Webhooks 参照) - 使用量分析 — モデルごとの使用量の急増がフェイルオーバーのアクティビティを示します