コンテンツへスキップ

すべてのリクエストを 最適なモデルに

MixRoute Smart Routingは、自社開発のAIモデルを用いてすべてのリクエストをリアルタイムで解析し、その複雑さやタスクの種類を判断した上で、お客様が承認したモデルプールから最適なモデルを割り当てます。実環境での数万回に及ぶ実行実績において、APIコストを平均20~40%削減しています。

1万件以上の実測 平均節約 20~40% 期間限定無料 データ保持ゼロ
返品方法は?
この会議を要約して
営業時間は?
このモジュールをリファクタリング

スマートルーティング

リアルタイム判定

シンプル

gemini-3.5-flash

複雑

claude-sonnet-5

ウルトラ

gpt-5.6-sol

ルーティング決定の図解

フラッグシップモデルが不要な質問に、 フラッグシップ並みの料金を払っている

  • オーバースペックがデフォルト

    サポート問い合わせの8割は「返品方法は?」「営業時間は?」といった単純なもの。それでもすべて、最上位モデルの料金で請求されています。

  • 一度決めたら見直さない

    エンジニアはリリース時に機能ごとに1つのモデルを選び、その後は見直しません。タスクは変わり続けても、モデルは変わりません。

  • 追いきれないアップデート

    モデル市場は毎月変わります。先月のベストコスパは、今月にはすでに更新されているかもしれません。人力では追いきれません。

問題はモデルではなく、 割り当ての仕方にあります。

仕組み

3ステップで完全自動

1

Step 1

いつも通り呼び出す

コードの変更は一切不要です。コンソールでスマートルーティング用のAPIキーを作成し、現在のキーと入れ替えるだけ。リクエスト形式はそのままです。

python キーを1つ入れ替える
client = OpenAI(
  api_key="sk-your-current-key",
  api_key="sk-smart-routing-key",
  base_url="https://api.mixroute.ai/v1"
)
# request format unchanged
2

Step 2

リアルタイム判定

自社ルーティングモデルが各リクエストをその場で読み取り、複雑さとタスク種別を判断します。100万トークンのコンテキストに対応し、最長のリクエストも完全に評価できます。読み取り専用・保存なし:内容はメモリ内で処理され、判定完了と同時に消去されます。MixRouteのデータ保持ゼロ方針に完全準拠しています。

判定内容 複雑さ × タスク種別
コンテキスト 1M tokens
処理場所 メモリ内のみ
判定後 即時消去
データ保持 ゼロ
3

Step 3

最適モデルへ割り当て

承認済みモデルプールから、このリクエストに最適なモデルを選択します。コンテキスト全体はそのまま通過し、書き換え・圧縮・切り捨ては行いません。応答は実際のモデルから返されます。

gemini-3.5-flash 待機
claude-sonnet-5 今回最適
deepseek-v3.2 待機
gpt-5.6-sol 待機

コンテキスト全体をそのまま通過。応答は実際のモデルから返されます。

コントロール

ルーティングはAIが担当。 境界線はあなたが決める。

完全自動のブラックボックス型ルーターは、「どのモデルを使うか」の決定権をあなたの手から奪います。MixRouteは逆のアプローチです。スマートルーティングは、あなたが定めた境界内でのみ動作します。

モデルプールは自由に設定

コンソールで各キーごとにモデルプールを設定できます。どのモデルエンドポイントを割り当て可能にするかは、すべてあなた次第です。信頼できるもの、コンプライアンスに適合するもの、予算内のものだけを選べます。

制限はあなたが設定

各キーに利用制限を設定し、超過分はブロック。リクエストの暴走も、請求の暴走も起きません。

節約効果が見える

組み込みの節約ダッシュボードで、スマートルーティングがどれだけ節約したかが一目瞭然。当社の主張ではなく、あなたの数字です。

Model pool sk-…prod-router
  • claude-sonnet-5
  • gpt-5.6-sol
  • gpt-5-mini
  • gemini-3.5-flash
  • deepseek-v3.2
  • grok-4
節約ダッシュボード 今月

スマートルーティングの節約額

US$1,284

31.4% 節約
支出
節約分

画面イメージ

実測データ

1万件以上の実測結果

数万件の実タスクでスマートルーティングの割り当てを検証した結果、APIコストを平均20~40%削減できました。実際の数値はモデルプールのベンダー構成によって異なるため、マーケティング数字ではなく実測レンジをお伝えしています。

あなたの節約額を試算

月間API支出
US$500 US$50,000

月間節約見込み

1万件以上の実測における平均節約レンジから試算。実際の節約額はモデルプール構成により異なります。

活用シーン

チームが最も効果を感じる場面

  • シナリオ 01

    高トラフィックのサポートボット

    大量の単純・反復的な質問こそ、スマートルーティング最大の節約源です。簡単な質問は軽量モデルへ、難しい質問は自動アップグレード。顧客は気づきませんが、請求書には現れます。

    最大の節約
  • シナリオ 02

    社内ナレッジアシスタント

    規程検索、文書検索、会議要約——多くのリクエストにフラッグシップは不要ですが、時には深い分析が必要です。ルーターが自動で見分けます。

    深さを自動判定
  • シナリオ 03

    混合ワークロードのAIプロダクト

    ユーザーが何を聞くかは予測できず、単純と複雑が入り混じります。1つのモデルに賭けるのではなく、各リクエストに最適なモデルを割り当てましょう。

    最適サイズの割り当て
  • シナリオ 04

    コーディングアシスタント

    補完や小さな関数は軽量モデルで高速・低コスト。ファイル横断のリファクタリングや難解なデバッグは自動でフラッグシップへ。エンジニアはコードに集中し、モデル選びはルーターにお任せ。

    自動ギアシフト

料金

まず試して、あとで決める

US$0

期間限定無料

今すぐ有効化すれば、ローンチ期間中はスマートルーティングが完全無料。実際のトラフィックで節約効果を検証してください——ダッシュボードの数字が答えを示します。

5%

その後はルーティング1件につき5%

無料期間後は、スマートルーティング経由のリクエストにのみ、リクエスト金額の5%を手数料として請求します。通常キーのリクエストには課金されません。

ひと言でいうと

5%を支払い、平均 20~40%を節約。

節約額は支払額をはるかに上回ります。それがこの機能が存在する理由です。

FAQ

よくある質問

はい。トリアージでは手順が1つ増えますが、所要時間はリクエストの長さによって異なります。これはトレードオフであり、わずかな時間を費やすことで、コストを20~40%削減できます。レイテンシが重要なエンドポイントの場合は、通常のキーを使用して特定のモデルを直接呼び出し、ルーターを経由しないようにしてください。

「読み取り専用」であり、決して保存することはありません。リクエスト内容はメモリ内でリアルタイムに分類され、その直後に消去された後、変更されることなくターゲットモデルに渡されます。MixRouteの「データ保持ゼロ」ポリシーに準拠し、永続ストレージには何も書き込まれません。

モデルプールは一種の「保険」のようなものです。ルーターは、ユーザーが承認したモデルの中からしか選択せず、プール外のモデルを割り当てることは決してありません。特定のモデルに常にトラフィックを転送する必要がある場合は、そのモデル用に別の通常のキーを作成し、そのモデルを直接呼び出してください。

一言で言えば、「制御」です。ほとんどの自動ルーティングツールは、プラットフォーム側がすべてを決定する完全なブラックボックスです。MixRouteのスマートルーティングは、ユーザーが定義したモデルプール内で動作し、データの保持は一切行われず、コスト削減状況を確認できるダッシュボードも備わっています。どこでコストが削減されたか、データがどこに送られているかを常に把握できます。

いいえ。コンソールでスマートルーティング用のAPIキーを作成し、現在のキーと入れ替えてください。API呼び出しの形式はまったく変わりません。

期間限定で無料です。無料期間が終了すると、スマートルーティングを経由したリクエストのみ、そのリクエストの費用に対して5%の手数料が課金されます。手数料はクレジット残高から差し引かれ、明細が明確に記載された請求書が発行されます。