高度な機能

自動フェイルオーバー

プライマリモデルプロバイダーにダウンタイムが発生した場合、TokSpan は自動的にトラフィックをバックアップモデルにルーティングします — リクエストの損失や手動介入は一切ありません。

仕組み

TokSpan は上流プロバイダーの状態をリアルタイムで監視しています。プロバイダーが 5xx エラーを繰り返し返すか、タイムアウトしきい値を超えた場合、トラフィックは自動的にフェイルオーバーチェーン内の次のモデルにリダイレクトされます。プライマリが復旧すると、トラフィックは通常のルーティングに戻ります。

フェイルオーバーチェーンはダッシュボードでモデルごとに設定します — クライアント側でのカスタムヘッダーやコード変更は不要です。

ダッシュボードでのフェイルオーバー設定

  1. TokSpan ダッシュボードapi.tokspan.com/dashboard)にログインします
  2. サイドバーの Channels に移動します
  3. フェイルオーバーで保護したいモデルチャネルを選択します
  4. チャネル設定で Model Mapping または Priority の設定を見つけます
  5. 優先順位順にバックアップモデルを追加します — リスト内で最初に利用可能なモデルがトラフィックを処理します
  6. フェイルオーバーをトリガーするタイムアウトリトライ回数のしきい値を設定します
  7. チャネル設定を保存します

耐障害性の高いフェイルオーバーチェーンの構築

本番ワークロードには、クロスプロバイダーのフェイルオーバー戦略を推奨します:

優先度モデルプロバイダー役割
1(プライマリ)GPT-4oOpenAIデフォルト — 総合的に最高品質
2(フォールバック)Claude Sonnet 4.6AnthropicOpenAI がダウンした場合に作動
3(最終手段)Gemini 2.5 FlashGoogle予算に優しいセーフティネット
プロのヒント:フェイルオーバーチェーンには、必ず異なるプロバイダーのモデルを少なくとも1つ含めてください。プロバイダーレベルの障害が最も一般的な故障モードです。クロスプロバイダーチェーン(OpenAI → Anthropic → Google)が最も強力な保護を提供します。

フェイルオーバーイベントの監視

フェイルオーバーのアクティビティは以下で追跡できます:

  • ダッシュボードログ — チャネルでフィルタリングしてフェイルオーバーがトリガーされたリクエストを確認
  • Webhookssystem.incident イベントをサブスクライブしてリアルタイムのフェイルオーバー通知を受信(Webhooks 参照)
  • 使用量分析 — モデルごとの使用量の急増がフェイルオーバーのアクティビティを示します