毎回モデルを選ぶ手間は省きたい。でも、意図せず高額なモデルに振り分けられるのは困る――そんな用途に向けたのがOpenRouterのAuto Routerだ。openrouter/autoへ送ったプロンプトを約30種類のタスクに分類し、静的なリーダーボードではなく、プラットフォーム上の週55T超のトークン利用額が示す選好を基にモデルを選ぶ。2026年8月10日、OpenRouterは従来のNotDiamondベースの仕組みを、直近7日間のコミュニティ利用シグナルで動くルーターへ置き換えた。デフォルトティアでは低コスト化、maxティアでは最先端モデル級の品質をうたう。一方で、リクエストごとのルーティング料金はかからないものの、最終的な請求額は選ばれたモデル次第だ。設定しないまま使うと、単純なプロンプトでも高価なモデルに送られる可能性がある。
新しいOpenRouter Auto Routerでできること
Auto Routerはメタルーターだ。モデル名にopenrouter/autoを指定してリクエストすると、実際には個別の基盤モデルへプロンプトが転送される。支払うのはそのモデルの通常料金だけで、ルーティング手数料が上乗せされることはない。レスポンスのmodelフィールドには選択されたモデルが入るため、リクエスト単位で利用先を確認できる。
2026年8月のアップデートでは、従来NotDiamondが担っていたルーティングエンジンを、OpenRouterが「wisdom of the market」と呼ぶ方式に刷新した。固定の分類モデルが「最適」なモデルを決めるのではなく、匿名化された直近7日間の支出データを参照する。たとえば先週、多数の開発者がコーディング用途をあるモデルから別のモデルへ移していれば、ルーターも数日以内にその変化を追随する。
プロンプトは処理中に分類されるため、プロンプトを保持する必要はない。対象はコード生成、デバッグ、複数ステップのエージェント計画、知識Q&A、数学、カスタマーサポート、調査レポートなど、約30カテゴリーに及ぶ。分類データやランキングデータを取得できない場合は、デフォルトのモデルセットへフォールバックするため、ルーティングの失敗でリクエスト自体が失敗することはない。
利用できるslugは2種類ある。
| Slug | 用途 | Plugin ID |
|---|---|---|
openrouter/auto | 一般提供されている安定版ルーター | auto-router |
openrouter/auto-beta | ルーティング更新を先行提供するチャネル | auto-beta-router |
新ルーターは安定版slugへ移行する前の数週間、auto-betaで稼働していた。移行日は2026年8月10日だ。誤ったPlugin IDで設定を送ると、エラーにならず無視される。設定時に見落としやすいポイントである。
約30のタスク分類と5段階のコストティアで選ぶ仕組み
モデル選択は、タスク分類とコストティアという2つの要素で決まる。まずプロンプトからタスク種別を特定し、その種別内で、過去7日間のコミュニティ利用シェアを基に候補モデルを順位付けする。この時点で、アカウント側の制限も反映される。対象になるのは許可モデル、ガードレール、プライバシー設定、ZDRポリシーだ。
コストティアは、ルーターがどの価格帯までモデルを選択対象にするかを決める。安価な順にlow、medium、high、xhigh、maxの5段階で、デフォルトはlowだ。ティアは上限額ではなく価格帯を示すものなので、その帯より安いモデルも高いモデルも対象外になる。
OpenRouterが2026年8月10日に公開したルーティングマトリクスは、約30のタスク種別をカバーしている。以下の代表的な15例を見ると、タスクとコストティアの組み合わせがモデル選択にどう影響するかが分かる。
| タスク種別 | Low | Medium | High | Xhigh | Max |
|---|---|---|---|---|---|
| コード生成 | glm-5.2 | claude-4.6-sonnet | kimi-k3 | claude-opus-5 | claude-5-fable |
| デバッグ | deepseek-v4-pro | glm-5.2 | gemini-3.6-flash | claude-4.8-opus | claude-opus-5 |
| コードレビュー | glm-5.2 | claude-sonnet-5 | kimi-k3 | gpt-5.6-sol | claude-opus-5 |
| SQL・データベース | deepseek-v4-flash | glm-5.2 | claude-sonnet-5 | kimi-k3 | claude-opus-5 |
| フロントエンド・UI | glm-5.2 | claude-sonnet-5 | gpt-5.6-sol | kimi-k3 | claude-5-fable |
| DevOps・設定 | deepseek-v4-flash | glm-5.2 | gpt-5.6-sol | kimi-k3 | claude-opus-5 |
| 複数ステップの計画 | deepseek-v4-pro | glm-5.2 | claude-4.8-opus | kimi-k3 | claude-5-fable |
| Web検索 | deepseek-v4-flash | glm-5.2 | gpt-5.6-sol | kimi-k3 | claude-4.6-opus |
| 数学 | deepseek-v4-pro | glm-5.2 | gemini-3.1-pro | kimi-k3 | claude-4.6-opus |
| コンテンツ執筆 | glm-5.2 | gemini-3.6-flash | claude-4.8-opus | claude-4.6-opus | gpt-5.6-sol |
| 調査レポート | deepseek-v4-pro | glm-5.2 | claude-sonnet-5 | gpt-5.6-sol | claude-opus-5 |
| Q&A・知識 | glm-5.2 | gemini-3.6-flash | claude-sonnet-5 | kimi-k3 | gpt-5.6-sol |
| 翻訳 | deepseek-v4-flash | gemini-3-flash | gemini-3.5-flash | claude-sonnet-5 | gpt-5.6-sol |
| 分類 | gemini-3-flash | gemini-3.5-flash | gemini-3.6-flash | gemini-3.1-pro | gpt-5.6-sol |
| カスタマーサポート | gemini-3-flash | gpt-4.1 | gemini-3.6-flash | claude-4.6-sonnet | claude-opus-5 |
lowティアでは、コーディング用途にGLM-5.2やDeepSeek V4 Flash、分類やサポート用途にGemini Flash系など、比較的安価なモデルが選ばれやすい。maxティアでは、タスクに応じてClaude Opus 5、Claude 5 Fable、GPT-5.6 Solへルーティングされる。
旧cost_quality_tradeoffと新cost_tierの違い
従来の数値パラメータcost_quality_tradeoffは非推奨になったが、引き続き受け付けられる。値は0〜10で、0は品質優先、10はコスト優先、デフォルトは7だった。新しいcost_tierでは数値ではなく名前付きの価格帯を使う。両方を送った場合は、cost_quality_tradeoffが優先される。後方互換性のための仕様だが、既存コードを移行する際には想定外のルーティングを招くことがある。cost_tierへ移行するなら、古いパラメータは削除しておきたい。
APIリクエストでの設定例:
{
"model": "openrouter/auto",
"messages": [{ "role": "user", "content": "Debug this Python function" }],
"plugins": [{
"id": "auto-router",
"cost_tier": "max",
"allowed_models": ["anthropic/*", "openai/*"]
}]
}
allowed_modelsにはanthropic/*のようなワイルドカードパターンを指定でき、プロバイダー単位で候補を絞り込める。excluded_modelsはallowed_modelsの後に評価され、候補プールをさらに狭めるために使う。フィルタリング後にモデルが1つも残らなければ、APIは404を返す。
ベンチマークで見る新旧Auto Routerの差
OpenRouterは5種類の異なるベンチマークで、新旧ルーターを比較した。対象はデフォルト設定とmax設定の両方だ。旧ルーターのデフォルトはcost_quality_tradeoff=7、新ルーターのデフォルトはcost_tier=lowとなっている。
デフォルトティアでは、新ルーターは5ベンチマーク中3つで旧ルーターと同等以上の結果だった。特にDSQA(調査、+45.6%)とWideSearch(検索、+16.0%)での伸びが大きい。一方、MMLU Pro(-1.6%)とtau-bench Banking(-1.9%)はわずかに低下し、SWE-Atlas QnAは同等だった。デフォルトティアのコストはMMLU Pro(-64.2%)、tau-bench(-51.3%)、SWE-Atlas(-35.9%)で低下したが、DSQAでは87.6%上昇している($147.11に対して$276)。maxティアでは新ルーターが5ベンチマークすべてで上回った。tau-bench Bankingは7.2%から31.6%へ(+338.9%)、SWE-Atlas QnAは2.4%から60.7%へ(+2429.2%)伸びた。ただしmaxティアのコストは5件中4件で高く、SWE-Atlasは$205に対して$1,325だった。これらは特定時点での結果であり、コミュニティの選好変化に合わせてルーティング挙動も変わるとOpenRouterは注意を促している。
想定外の請求を防ぐAuto Routerのコスト管理
Auto Routerでよく挙がる懸念は、予期しない料金だ。あるr/openrouterユーザーは、次のように表現している。
「Opusを使い続けるかもしれない。」 - エンジニアリングチームで高額モデルの選択を制御できないリスクについてのu/xtekno-idの警告。
コストを予測可能な範囲に収めるには、次の5点を押さえたい。
1. :freeサフィックスは無料モデル限定ではない。 openrouter/auto:freeを指定しても、Auto Routerが無料モデルだけに制限されるわけではない。有料モデルへルーティングされることもある。コストゼロのルーティングが必要なら、無料ティアのエンドポイントだけに候補を限定するopenrouter/freeを使う。これはOpenRouterのヘルプセンターでも明記されている。
2. cost_tierとallowed_modelsを組み合わせる。 cost_tier=lowだけでは、利用量に対して高コストなモデルが選ばれることを防げない。allowed_modelsも指定し、特定のモデルファミリーに絞ろう。たとえば["deepseek/*", "google/*"]なら、大半のタスク種別で低予算帯に収められる。
3. 厳密な上限にはprovider.max_priceを使う。 このパラメータは価格に基づいて利用可能なエンドポイントをフィルタリングする。ルーターのティア選択とは独立して機能する、トークン単価の上限設定になる。
4. 5.5%のプラットフォーム手数料も確認する。 OpenRouterが課金する5.5%の手数料は、トークンごとではなくクレジット購入時のものだ。最低額は$0.80で、$20分のクレジットを入金する場合は$21.10かかる。この手数料はAuto Router利用の有無を問わず発生する。ルーティングの追加料金ではなく、プラットフォームの収益化レイヤーだ。
5. セッション固定とキャッシュ再構築のコストを意識する。 会話の途中でルーターがモデルを切り替えると、入力キャッシュを作り直す必要があり、トークンコストが増える。これに対応するのがセッション固定だ。明示的なsession_idまたはメッセージフィンガープリントで会話を識別し、各ターンで候補を再順位付けしながらも、前のモデルが有力候補に残っていれば優先する。タスクが大きく変わればモデルは切り替わり、キャッシュ再構築コストも発生する。
Auto Routerを使うべき場面とモデルを固定すべき場面
Auto Routerが向くのは、時々でタスク種別が変わり、手動でのモデル選択がボトルネックになる可変ワークロードだ。ルーティングマトリクスは、各タスクでコミュニティがどのモデルを信頼しているかを把握する出発点にもなる。
| 利用シーン | 推奨 |
|---|---|
| 可変ワークロード、汎用的な利用 | cost_tier=lowを指定したopenrouter/auto |
| 大規模かつコスト重視の本番運用 | 特定モデルを固定するか、フォールバックリストを使う |
| コンテキストを伴う複数ターンのコーディング | 固定性のためsession_idを付けたopenrouter/auto |
| コストを問わず最先端の品質が必要 | cost_tier=maxを指定したopenrouter/auto |
| コストゼロが必須 | openrouter/free(auto:freeではない) |
| 安定版リリース前のルーティング更新を試したい | openrouter/auto-beta |
エンジニアリングチームにとっての実用的な落としどころは、制約を設けたAuto Router構成だ。予算に合う帯へcost_tierを設定し、承認済みベンダーにallowed_modelsを限定したうえで、provider.max_priceを厳格な上限として使う。
FAQ
OpenRouter Auto Routerに追加料金はかかる?
かからない。Auto Routerの利用に追加料金はなく、選択されたモデルの通常料金だけを支払う。OpenRouterの収益は、クレジット購入時に課金される5.5%の手数料によるものだ。
openrouter/auto:freeは本当に無料?
いいえ。:freeサフィックスを付けても、無料モデルだけにルーティングされるわけではない。無料専用ルーターであるopenrouter/freeを使う。
Auto Routerを特定プロバイダーだけに制限できる?
できる。auto-routerプラグインで、["anthropic/*", "openai/*"]のようなワイルドカードパターンを含むallowed_modelsパラメータを指定する。
選ばれたモデルはどう確認する?
APIレスポンスのmodelフィールドを確認する。ここにはopenrouter/autoではなく、リクエストを実際に処理したモデルの識別子が入る。
autoとauto-betaの違いは?
openrouter/autoは安定版ルーターで、openrouter/auto-betaには安定版へ反映される前のルーティング改善が配信される。
Auto Routerはストリーミングとツール呼び出しに対応している?
対応している。選択されたモデルが備えるストリーミング、ツール呼び出し、ビジョンなどの機能はすべて利用できる。