コンテンツへスキップ

スマートルーティング

AI利用料を 20~40%削減するAIゲートウェイ

MixRoute スマートルーティングは、自社開発のAIモデルで各リクエストをリアルタイムに解析し、複雑さとタスクの種類を判断したうえで、許可されたモデルプール内の最適なモデルへ送信します。

1万件以上の実測
1万件以上の実測
平均節約 20~40%
平均節約 20~40%
期間限定無料
期間限定無料
データ保持ゼロ
データ保持ゼロ
返品方法は? この会議を要約して 営業時間は? このモジュールをリファクタリング
スマートルーティング リアルタイム判定
シンプル Gemini 複雑 Claude ウルトラ GPT
ルーティング決定の図解

実測データ

1万件以上の実測結果

数万件の実タスクでスマートルーティングの割り当てを検証した結果、APIコストを平均20~40%削減できました。実際の数値はモデルプールのベンダー構成によって異なるため、マーケティング数字ではなく実測レンジをお伝えしています。

あなたの節約額を試算

月間API支出 US$5,000
US$500 US$50,000

月間節約見込み

1万件以上の実測における平均節約レンジから試算。実際の節約額はモデルプール構成により異なります。

フラッグシップモデルが不要な質問に、 フラッグシップ並みの料金を払っている

オーバースペックがデフォルト

サポート問い合わせの8割は「返品方法は?」「営業時間は?」といった単純なもの。それでもすべて、最上位モデルの料金で請求されています。

一度決めたら見直さない

エンジニアはリリース時に機能ごとに1つのモデルを選び、その後は見直しません。タスクは変わり続けても、モデルは変わりません。

追いきれないアップデート

モデル市場は毎月変わります。先月のベストコスパは、今月にはすでに更新されているかもしれません。人力では追いきれません。

問題はモデルではなく、 割り当ての仕方にあります。

仕組み

3ステップで完全自動

1

Step 1

いつも通り呼び出す

コードの変更は一切不要です。コンソールでスマートルーティング用のAPIキーを作成し、現在のキーと入れ替えるだけ。リクエスト形式はそのままです。

python キーを1つ入れ替える
client = OpenAI(api_key="sk-your-current-key",api_key="sk-smart-routing-key",base_url="https://api.mixroute.ai/v1")# request format unchanged
2

Step 2

リアルタイム判定

自社ルーティングモデルが各リクエストをその場で読み取り、複雑さとタスク種別を判断します。100万トークンのコンテキストに対応し、最長のリクエストも完全に評価できます。読み取り専用・保存なし:内容はメモリ内で処理され、判定完了と同時に消去されます。MixRouteのデータ保持ゼロ方針に完全準拠しています。

判定内容
複雑さ × タスク種別
コンテキスト
1M tokens
処理場所
メモリ内のみ
判定後
即時消去
データ保持
ゼロ
3

Step 3

最適モデルへ割り当て

承認済みモデルプールから、このリクエストに最適なモデルを選択します。コンテキスト全体はそのまま通過し、書き換え・圧縮・切り捨ては行いません。応答は実際のモデルから返されます。

  • gemini-3.5-flash 待機
  • claude-sonnet-5 今回最適
  • deepseek-v3.2 待機
  • gpt-5.6-sol 待機

コンテキスト全体をそのまま通過。応答は実際のモデルから返されます。

コントロール

ルーティングはAIが担当。 境界線はあなたが決める。

完全自動でありながら、決してブラックボックスではありません。スマートルーティングは、許可するモデルプール、設定する制限、確認できる節約額など、あなたが定めた範囲内でのみ動作します。

モデルプールはあなた次第

コンソールでAPIキーごとに独自のモデルプールを設定できます。割り当て可能なモデルエンドポイントは、すべてあなたが決められます。

制限はあなたが設定

各キーに利用制限を設定し、超過分はブロック。リクエストの暴走も、請求の暴走も起きません。

節約効果が見える

組み込みの節約ダッシュボードで、スマートルーティングがどれだけ節約したかが一目瞭然。当社の主張ではなく、あなたの数字です。

モデルプール sk-…prod-router
シンプル 軽量モデル Google

大量の軽量リクエスト:分類、抽出、FAQ。

複雑 コアモデル Anthropic

多段階の推論、コード、長文分析。

ウルトラ フラッグシップモデル OpenAI

最も高度な推論と重要な意思決定タスク。

節約ダッシュボード 今月

スマートルーティングの節約額

US$1,284

31.4% 節約
支出 節約分

画面イメージ

活用シーン

チームが最も効果を感じる場面

シナリオ 01

高トラフィックのサポートボット

大量の単純・反復的な質問こそ、スマートルーティング最大の節約源です。簡単な質問は軽量モデルへ、難しい質問は自動アップグレード。顧客は気づきませんが、請求書には現れます。

最大の節約

シナリオ 02

社内ナレッジアシスタント

規程検索、文書検索、会議要約——多くのリクエストにフラッグシップは不要ですが、時には深い分析が必要です。ルーターが自動で見分けます。

深さを自動判定

シナリオ 03

混合ワークロードのAIプロダクト

ユーザーが何を聞くかは予測できず、単純と複雑が入り混じります。1つのモデルに賭けるのではなく、各リクエストに最適なモデルを割り当てましょう。

最適サイズの割り当て

シナリオ 04

コーディングアシスタント

補完や小さな関数は軽量モデルで高速・低コスト。ファイル横断のリファクタリングや難解なデバッグは自動でフラッグシップへ。エンジニアはコードに集中し、モデル選びはルーターにお任せ。

自動ギアシフト

料金

まず試して、あとで決める

US$0

期間限定無料

今すぐ有効化すれば、ローンチ期間中はスマートルーティングが完全無料。実際のトラフィックで節約効果を検証してください——ダッシュボードの数字が答えを示します。

5%

その後はルーティング1件につき5%

無料期間後は、スマートルーティング経由のリクエストにのみ、リクエスト金額の5%を手数料として請求します。通常キーのリクエストには課金されません。

ひと言でいうと

5%を支払い、平均20~40%を節約。

節約額は支払額をはるかに上回ります。それがこの機能が存在する理由です。

FAQ

よくある質問

スマートルーティングによって遅延は生じますか?

はい。トリアージでは手順が1つ増えますが、所要時間はリクエストの長さによって異なります。これはトレードオフであり、わずかな時間を費やすことで、コストを20~40%削減できます。レイテンシが重要なエンドポイントの場合は、通常のキーを使用して特定のモデルを直接呼び出し、ルーターを経由しないようにしてください。

ルーティングモデルは私のデータを認識していますか?

「読み取り専用」であり、決して保存することはありません。リクエスト内容はメモリ内でリアルタイムに分類され、その直後に消去された後、変更されることなくターゲットモデルに渡されます。MixRouteの「データ保持ゼロ」ポリシーに準拠し、永続ストレージには何も書き込まれません。

もしルーターが誤った判断をした場合はどうなりますか?特定のモデルを強制的に指定することはできますか?

モデルプールは一種の「保険」のようなものです。ルーターは、ユーザーが承認したモデルの中からしか選択せず、プール外のモデルを割り当てることは決してありません。特定のモデルに常にトラフィックを転送する必要がある場合は、そのモデル用に別の通常のキーを作成し、そのモデルを直接呼び出してください。

これは、他のプラットフォームの自動ルーティングとどう違うのですか?

一言で言えば、「制御」です。ほとんどの自動ルーティングツールは、プラットフォーム側がすべてを決定する完全なブラックボックスです。MixRouteのスマートルーティングは、ユーザーが定義したモデルプール内で動作し、データの保持は一切行われず、コスト削減状況を確認できるダッシュボードも備わっています。どこでコストが削減されたか、データがどこに送られているかを常に把握できます。

コードを変更する必要がありますか?

いいえ。コンソールでスマートルーティング用のAPIキーを作成し、現在のキーと入れ替えてください。API呼び出しの形式はまったく変わりません。

価格設定はどのように行われるのですか?

期間限定で無料です。無料期間が終了すると、スマートルーティングを経由したリクエストのみ、そのリクエストの費用に対して5%の手数料が課金されます。手数料はクレジット残高から差し引かれ、明細が明確に記載された請求書が発行されます。

すべてのコストを、 効果的なところへ

期間限定無料。ダッシュボードで実証を確認してください。

営業に相談