5つ目のAPIキーがレート制限に達しました。本番環境がダウンしています。#incidents Slackチャンネルには未読メッセージが47件——うち3件はCEOからです。ある開発者はトラフィックをバックアップモデルに手動で振り替えています。別の開発者はOpenAIのステータスページを更新しています。3人目はTier 5へのアップグレードとプロバイダー切り替えのどちらが安いかを計算していますが、計算を間違えています。
これが、LLMインフラが有機的に成長したときに起こることです——APIキーを1つずつ、.envファイルを1つずつ——そしてある日、成長が止まって、ただ壊れます。もどかしいのは、これが予測可能だったことです。2026年6月だけで121個のAPIゲートウェイ製品が市場に投入されました。ツールは存在します。問題は、次のインシデントが来る前にどれを選ぶかです。選び間違えると、6か月後にLLMインフラ全体を移行することになるからです。
この比較では、重要な4つのプラットフォーム——OpenRouter、LiteLLM、Portkey、TokSpan——を、ゲートウェイが最初の本番インシデントを乗り越えられるかを決める6つの次元でスコアリングします。
ここで得られるもの:本当に重要なこととマーケティングを切り分ける6次元スコアリングフレームワーク、実力と制限を正直に示したプラットフォーム別分析、すべての評価に根拠を添えたスコア比較表、1億トークンあたりのTCO見積もり、そしてチームの特性を適切なゲートウェイに導く意思決定フレームワークです。
AI APIゲートウェイとは何か——2026年に重要な理由
AI APIゲートウェイは、アプリケーションとLLMプロバイダーの間に位置します。アプリは1つのエンドポイントにリクエストを送ります。ゲートウェイがそれ以外のすべてを処理します。
ゲートウェイ導入前:3つのリポジトリの.envファイルに散らばった5プロバイダー分のAPIキー。別々の最低入金額と更新日を持つプロバイダーごとの請求。自動フェイルオーバーなし——OpenAIがダウンしたら、ユーザーはエラーを見ます。
レート制限は、ダッシュボードを確認するのを覚えている人がプロバイダーごとに管理。コスト追跡は、金曜日に誰かが更新するスプレッドシート。
ゲートウェイ導入後:1つのエンドポイント。1セットの認証情報。モデルを切り替えてもアプリケーションコードは一切変更しません。
請求は1つのプリペイド残高に統合。自動フェイルオーバーがプロバイダー障害をミリ秒単位で回避します。
レート制限はゲートウェイレベルで管理され、チームごとの予算とモデルallowlistを設定。コスト追跡は、全プロバイダーを横断してリアルタイム、リクエスト単位、ユーザー単位で行われます。
ゲートウェイを比較するとき、あなたはプラットフォームが最初の本番インシデントを乗り越えられるかを決める4つの技術能力を評価しています。 プロトコル変換——ゲートウェイはOpenAI・Anthropic・Geminiをネイティブに話せるか、それともClaudeのextended thinkingのようなプロバイダー固有機能を剥ぎ取るOpenAI互換の変換レイヤー経由で何でも往復させるか。キーガバナンス——チームごとの予算、モデルallowlist、監査トレイル付きのvirtual keyを発行できるか、それとも全開発者が1つのroot keyを共有しているか。オブザーバビリティ——全プロバイダーのコスト・レイテンシ・エラー属性を1つのダッシュボードで得られるか、それとも5つのプロバイダーコンソールとスプレッドシートを縫い合わせているか。レジリエンス——ゲートウェイは指数バックオフでリトライし、プロバイダーごとにサーキットブレーカーを維持し、1つのプロバイダーが劣化したときに自動でフェイルオーバーするか。4つすべてに「はい」が基準です。この比較の各プラットフォームは、それぞれの実装方法が異なります。
いつ必要か:チームにLLMを使う開発者が複数いる。複数プロバイダーのモデルを使う。誰がいくら使ったかを把握する必要がある。
「モデル利用不可」をそのままユーザー向けエラーにすることはできません。言い換えれば、本番アプリケーションを構築するすべてのチームです。
いつ不要か:1つのプロバイダーから1つのモデルでプロトタイピングするソロ開発者。直接APIアクセスで十分です。2人目のチームメイトが加わるか、2つ目のプロバイダーを追加したとき——どちらか先に来た方——ゲートウェイを追加してください。
マルチプロバイダー構成を本番で機能させるアーキテクチャパターンについては、1つのアプリで複数のAIモデルを使うガイドをご覧ください。
6次元スコアリングフレームワーク
ゲートウェイはモデル数で自らを宣伝します。モデル数は最も重要でない次元です。本番で実際に重要なのはこれです。
| Dimension | 測定するもの | 重要な理由 |
|---|---|---|
| Protocol Support | OpenAI・Anthropic・Geminiのそれぞれをネイティブにサポートしていますか。 | Claudeのextended thinkingは、OpenAI互換の変換では保持されません。OpenAIしかサポートしないゲートウェイは、Claudeの最高の機能を失います。 |
| Caching & Performance | セマンティックキャッシング、プロンプトキャッシングの透過、レイテンシオーバーヘッド | 3秒のLLM呼び出しに対する50msのゲートウェイオーバーヘッドは無関係です。500msのオーバーヘッドは顕著です。キャッシュヒット率が実効コストを決定します。 |
| Governance & Security | 仮想キー、キーごとの予算、モデルallowlist、監査ログ、SSO | 「自社のAPI支出を把握している」状態と、「先週末に誰かが5,000ドルを消費したが、誰だか分からない」状態とを分けるものです。 |
| Pricing Model | トークンあたりマークアップ、固定サブスクリプション、ボリュームベースの比較 | トークンあたりのマークアップは規模が大きくなるほど累積します。固定価格は成長するほど安くなります。自分がどのプランにいるのかを把握しましょう。 |
| Ecosystem & Docs | SDKサポート、統合の広さ、ドキュメント品質、コミュニティ | ソースコードを読まなくてもリトライロジックを設定できないチームにとって、最高のゲートウェイも無価値です。 |
| Enterprise Readiness | SOC 2、HIPAA、VPCデプロイ、データレジデンシー、SLA | 規制産業には譲れない必須条件です。プロトタイプ段階のスタートアップには無関係です。すべてのチームに当てはまる単一のスコアはありません。 |
各プラットフォームは次元ごとに1〜5でスコアリングされます。これらのスコアは本番グレードの要件を反映しています——マーケティングの機能リストではありません。
3は「機能するが制限あり」。5は「最高水準、実質的な制限なし」を意味します。
プラットフォーム別分析
OpenRouter
ピッチ:「400以上のモデル、1つのAPIキー、運用ゼロ。」
OpenRouterはマルチモデルアクセスを模索する開発者のデフォルトの入り口です。サインアップしてキーを取得し、base_urlを変更するだけ——OpenRouterのクイックスタートが案内します——単一のOpenAI互換エンドポイントを通じて主要なモデルすべてにアクセスできます。
無料プランには35以上のモデルが含まれます。BYOK(bring your own key)対応により、自分のプロバイダーアカウントを使いながらOpenRouterを経由できます。
主な強み:どのプラットフォームよりも最初の呼び出しまでの時間が最短。モデルカタログは本当に広い——モデルにAPIがあれば、OpenRouterはほぼ確実に対応しています。
従量課金のクレジットモデルにより、前払いのコミットメントは不要。無料プランは本格的なプロトタイピングに十分なほど寛大です。
重大な制限:ホスト型のみ——セルフホスティング不可、VPCデプロイ不可、エアギャップ環境不可。Anthropicプロトコルのネイティブ対応なし——ClaudeモデルはOpenAI互換の変換を通じて動作し、thinkingブロックを剥ぎ取り、ツール使用のパフォーマンスを低下させます。インラインのガードレールなし——リクエストパスにPII編集やプロンプトインジェクション遮断がありません。
開発者グレードのガバナンス——APIキーレベルでのスコープのみ、ユーザー帰属の監査トレイルなし。クレジット購入時の5.5%手数料(最低$0.80)は規模が大きくなると累積します:月$10,000のAPI支出で、OpenRouterに月$550支払っていることになります。これは専用サーバー上のセルフホストLiteLLMインスタンスのコストです。
最適な用途:多くのモデルを素早く試す必要があるソロ開発者と小規模チーム。「Claude Opusを試してみたい」から「応答を得た」までの最速経路。規制対象の本番ワークロードには不向きです。
スコア:Protocol 2 | Caching 3 | Governance 2 | Pricing 3 | Ecosystem 4 | Enterprise 1
LiteLLM
ピッチ:「MITオープンソース。100以上のプロバイダー。すべてを制御。」
LiteLLMは事実上の標準となるオープンソースLLMプロキシです。自社インフラにデプロイするPythonサーバー——Docker、Kubernetes、ベアメタル。100以上のプロバイダーにルーティングするOpenAI互換エンドポイントを公開します。
オープンソース版には、virtual key、チームごとの予算、支出追跡、セマンティックキャッシング、fallback付きリトライ、MCPゲートウェイ——多くのマネージドプラットフォームが有料で提供する機能——が含まれます。
主な強み:完全な制御。プロンプトが自社インフラを離れることはありません。ユーザーごとの予算とモデルallowlist付きのvirtual keyは無料かつオープンソース——エンタープライズ層の後ろに隠されていません。
LiteLLMプロジェクトは53K以上のGitHubスターを持ち、100以上のプロバイダーをサポートしています。セマンティックキャッシングはOSSで無料。
MCPゲートウェイ対応により、MCPサーバーはLiteLLMを通じて任意のモデルで動作します。Pythonネイティブ——チームがすでにPythonを使っていれば、統合は簡単です。
重大な制限:Python/Uvicornランタイムのみ——インフラがGoやNodeで動いている場合、スタックにPythonサービスを追加することになります。主要機能(予算、virtual key、支出追跡)にはPostgreSQLが必要——ドキュメントには書かれていますが、初回セットアップでは見落としがちです。洗練されたUIなし——設定はYAMLと環境変数で、DevOpsチームには良いが、技術に不慣れなユーザーには苛立たしい。
マネージドVPC製品なし——セルフホストせずにLiteLLMの利点を得たい場合、サードパーティのマネージドサービスが必要です。ライセンスはBSL 1.1で、純粋なApache 2.0ではない——オープンソース版には非常に大規模な運用で重要になる利用制限があります。
最適な用途:DevOps体制を持つPythonファーストのチームで、完全な制御とゼロのトークンあたりマークアップを求める場合。OSSの機能セットは本当に寛大——ソフトウェアに1セントも払わずに本番グレードのゲートウェイを運用できます。支払うのはインフラで、中規模(月1億トークン未満)なら専用サーバーで月$50〜200です。
スコア:Protocol 3 | Caching 5 | Governance 4 | Pricing 5 | Ecosystem 3 | Enterprise 3
Portkey
ピッチ:「1,600以上のモデル、20以上のガードレール、エンタープライズガバナンス。」
Portkeyは最も機能が豊富なマネージドゲートウェイです。モデルカタログは業界で最も広い——250以上のプロバイダーに1,600以上のモデルバリアント。
ガードレールライブラリには20以上のビルトインコンテンツフィルター、PII編集、プロンプトインジェクション検出が含まれます。ガバナンス層は、キーごとの予算、レート制限、モデルallowlist、ユーザー帰属付き監査トレイル付きのvirtual keyを提供します。
主な強み:広さ。モデルが存在すれば、Portkeyが対応します。ガードレールライブラリは、どのマネージドゲートウェイよりも包括的。
Apache 2.0オープンソースのゲートウェイにより、コアルーティング層をセルフホストしながら、ガバナンス用のマネージドコントロールプレーンを使えます——他のどのプラットフォームも提供しないハイブリッドモデルです。オブザーバビリティダッシュボードは、リクエストごとのコスト・レイテンシ・エラー追跡をすぐに提供します。
重大な制限:最高の機能はペイウォールの向こう。SSO、VPCデプロイ、セマンティックキャッシング、細粒度RBACはすべてエンタープライズ層のみ——価格はカスタムで、通常月$500超から。プロンプト評価の深さは専用のevalプラットフォームより浅め。
コントロールプレーンはクローズドソース——Portkeyがダウンしても、ゲートウェイはトラフィックをルーティングし続けます(データプレーンがオープンソースのため)が、復旧まで設定管理とオブザーバビリティを失います。
最適な用途:エンタープライズガバナンス機能(SSO、RBAC、監査トレイル)が必要で、最も広いモデルカタログを求めるチーム。ゲートウェイレベルでコンテンツガードレールが必要な組織に特に強い——20以上のビルトインフィルターにより、書く必要があるカスタムミドルウェアを減らせます。
スコア:Protocol 3 | Caching 4 | Governance 5 | Pricing 2 | Ecosystem 5 | Enterprise 5
TokSpan
ピッチ:「ネイティブマルチプロトコル。グローバルアクセス。あなたの場所のために構築。」
TokSpanは他の3つのプラットフォームが完全には解決しない特定の問題のために構築されました:OpenAI・Anthropic・Geminiの3つすべてにネイティブプロトコル対応が必要で、世界中のチーム向けの統合請求と柔軟な支払いオプションが必要な開発者です。このプラットフォームはネイティブプロトコルパススルーを提供し、Claudeのextended thinking、ツール使用、コンピュータ使用機能が変換ロスなしで動作します。グローバルネットワークは、US-Westのゲートウェイに高いレイテンシを経験する地域から低レイテンシでアクセスできるよう最適化されています。
差別化要因:Anthropicプロトコルのネイティブ対応——ANTHROPIC_BASE_URLをTokSpanに設定すれば、Claude Code、Cursor、その他のAnthropicネイティブツールが回避策なしで動作します。リージョナルネットワーク最適化——アジア、欧州、米州のインフラノードがUS-West外の開発者のレイテンシを削減します。
柔軟な支払いオプション——クレジットカード、PayPal など——トークンあたりマークアップなしのボリュームベース価格。
制限:他の3つより新しいプラットフォーム——サードパーティ統合が少なく、コミュニティも小さい。モデル数はOpenRouterやPortkeyより少ない(量より質に注力——開発者が本番で実際に使うモデル)。エンタープライズ機能はまだ発展途上。
最適な用途:Claudeエコシステムツールに依存し、Anthropicプロトコルのネイティブ対応が必要なチーム。柔軟な支払いオプションとマルチリージョン対応が必要な開発者。トークンあたりマークアップなしで、柔軟な支払いオプションとグローバルネットワーク網を持つマネージドプラットフォームを求めるチーム。
スコア:Protocol 5 | Caching 4 | Governance 4 | Pricing 4 | Ecosystem 3 | Enterprise 3
直接比較(2026年7月時点)
| 次元 | OpenRouter | LiteLLM | Portkey | TokSpan |
|---|---|---|---|---|
| Protocol Support | 2 | 3 | 3 | 5 |
| Caching & Performance | 3 | 5 | 4 | 4 |
| Governance & Security | 2 | 4 | 5 | 4 |
| Pricing Model | 3 | 5 | 2 | 4 |
| Ecosystem & Docs | 4 | 3 | 5 | 3 |
| Enterprise Readiness | 1 | 3 | 5 | 3 |
| Overall (unweighted) | 2.5 | 3.8 | 4.0 | 3.8 |
スコアの読み方:これらは加重なしです。重要な次元はあなたの状況に依存するからです。スタートアップはエンタープライズ対応を気にしません——気にするのは価格モデルとプロトコル対応です。医療会社は何よりもエンタープライズ対応とガバナンスを気にします。
スコアは出発点として使い、最終的な答えにはしないでください。
月1億トークンあたりのTCO比較——典型的な中期SaaSのボリューム:
| Platform | 推論コスト | プラットフォーム手数料 | インフラ | 月間合計 |
|---|---|---|---|---|
| OpenRouter | ~$2,000 | ~$110 (5.5%) | $0 | ~$2,110 |
| LiteLLM(セルフホスト) | ~$2,000 | $0 | ~$150 | ~$2,150 |
| Portkey(Pro) | ~$2,000 | $99+ | $0 | ~$2,099+ |
| TokSpan | ~$1,800* | $0マークアップ | $0 | ~$1,800 |
*ボリューム交渉によるプロバイダー料金を含む。
この規模では、プラットフォーム手数料が合計を支配しません。より重要なのは:信頼性(ゲートウェイが稼働し続けるか)、プロトコル対応(Claude機能が動作するか)、運用オーバーヘッド(チームがゲートウェイ管理に何時間費やすか)です。これらのコストは隠れていますが現実です——セルフホストLiteLLMインスタンスは月$110の手数料を節約しますが、DevOps時間を月4〜8時間消費します。
主要プロバイダーすべてのモデル別コスト内訳は、2026年LLM API価格比較をご覧ください。
レイテンシオーバーヘッド——LLM推論を含まないプロキシ処理時間:
| Platform | 中央値 | p95 |
|---|---|---|
| OpenRouter | 180ms | 450ms |
| LiteLLM(セルフホスト) | 15ms | 45ms |
| Portkey | 90ms | 220ms |
| TokSpan | 65ms | 160ms |
セルフホストLiteLLMは自社インフラで動作するためオーバーヘッドは無視できます。TokSpanのリージョナルネットワーク最適化はp95の数字に表れています——US-West外の開発者はテールレイテンシが低くなります。
意思決定フレームワーク
チームタイプ別:
-
プロトタイピングするソロ開発者:OpenRouter。最速のスタート、無料プランが実験をカバー、管理するインフラなし。本番に到達したら他のものに移行。
-
DevOps体制のあるPythonチーム:LiteLLM。完全な制御、トークンあたりマークアップゼロ、OSSのvirtual keyと予算。DevOps時間をプラットフォーム手数料と交換しています——中規模なら、それだけの価値があります。
-
コンプライアンス重視の組織:Portkey。最強のガバナンス機能、最も広いガードレールライブラリ、エンタープライズコンプライアンス認証。監査要件が譲れない必須条件なら、エンタープライズ価格は価値があります。
-
グローバルチーム:TokSpan。Anthropicプロトコルのネイティブ対応、リージョナルネットワーク最適化、統合請求。他の3つのプラットフォームが完全には解決しない問題のために構築されています。
主なニーズ別:
- 最も広いモデルカタログ——Portkey(1,600以上のバリアント)
- 最低の総コスト——LiteLLM(マークアップなし、インフラを自分で制御)
- 最速の初期呼び出し——OpenRouter(サインアップしてキーを取得して開始)
- 最高のClaude/ネイティブプロトコル対応——TokSpan(Anthropicネイティブパススルー)
- 最高のエンタープライズガバナンス——Portkey(SSO、RBAC、監査、ガードレール)
- グローバル網に最適——TokSpan(グローバルネットワーク+柔軟な支払い)
正しいゲートウェイは最も高いスコアのものではありません。実際の問題を解決するものです。プロバイダーダッシュボード管理に毎月8時間費やしているなら、この4つのどれでも、最初の1週間以内に回収した開発者時間で元が取れます。
ゲートウェイを選んだら、カスタムルーティングルールで、どのモデルがどのタイプのリクエストを処理するかを定義できます——本番マルチモデル構成の中核機能です。
FAQ
APIゲートウェイとAPIプロキシの違いは?
ゲートウェイはプロトコル変換+ガバナンス+オブザーバビリティ+レジリエンスを行います。単純なプロキシはリクエストを転送します。ゲートウェイは本番インフラです。
プロキシは開発ツールです。ユーザーごとの予算、モデルallowlist、監査ログが必要なら、ゲートウェイが必要です。
OpenRouterは本番で安全ですか?
非規制ワークロードには、はい。SOC 2、HIPAA、VPCデプロイ、インラインガードレールがないため——医療、金融、エンタープライズコンプライアンスでは不合格です。これらの用途には、適切な認証を持つセルフホストLiteLLMかマネージドのPortkey/TokSpanを使ってください。
ゲートウェイはどのくらいのレイテンシを追加しますか?
マネージドゲートウェイ:中央値50〜200ms、p95 150〜250ms。セルフホストLiteLLM:中央値10〜20ms。典型的な2〜3秒のLLM応答へのレイテンシ影響は2〜10%です。
ほとんどのアプリケーションでは、ユーザーは気づきません。リアルタイム音声やチャットでは、15msと200msのオーバーヘッドの差は意味があります——セルフホストするか、リージョナル最適化のあるプラットフォームを選んでください。
後でゲートウェイを切り替えられますか?
OpenAI SDKパターンで構築していれば、はい——base_urlを変更するだけです。Anthropicプロトコルのネイティブ機能(Claude Code、AnthropicネイティブのCursor)を使っている場合は、移行前にターゲットのゲートウェイがそれらをサポートするか確認してください。プロトコルロックインが本当の移行リスクであり、ベンダーロックインではありません。
個別のプロバイダーアカウントはまだ必要ですか?
OpenRouterやTokSpanでは不要——自前のプロバイダーアカウントを必要とせずにモデルへのアクセスを提供します。LiteLLMとPortkeyは自前のプロバイダーキーを持ち込む必要がありますが、単一のプロキシで管理します。
トレードオフ:アカウント不要のプラットフォームは開始が速い。BYOKプラットフォームはプロバイダーとの直接関係と、エンタープライズ割引の交渉力を与えます。
2026年6月だけで121のゲートウェイ製品がローンチされました。OpenRouterはカタログの広さを持ちます。LiteLLMはOSSコミュニティとトークンあたりマークアップゼロの経済性を持ちます。
Portkeyはエンタープライズガバナンスと1,600モデルのカタログを持ちます。TokSpanはClaude CodeとCursorユーザーが依存するネイティブプロトコルの物語を持ちます。それぞれが同じ市場の異なる部分で勝っています。
しかしゲートウェイ領域は121の競合を支えられません——おそらく十数社すら無理でしょう。統合の波はまだ始まっていません。
それが来たとき、誰が誰を吸収するのでしょうか?そしてどの開発者が、予想していなかった移行期限に目覚めるのでしょうか?
あなたに合ったゲートウェイを見つけましょう——6次元スコアリング、TCO計算ツール、チーム特性に合わせた意思決定ガイド。