跳至内容

每一个请求, 都交给最适合的模型

MixRoute 智能路由以自研 AI 模型实时判读每个请求的复杂度与任务类型,在你授权的模型池内自动分配最适模型。上万次实测,平均节省 20–40% API 成本。

上万次实测 平均节省 20–40% 限时免费 零数据留存
怎么退货?
摘要这份会议记录
营业时间到几点?
重构整个交易模块

智能路由

实时判读

简单

gemini-3.5-flash

复杂

claude-sonnet-5

超复杂

gpt-5.6-sol

路由决策示意

你正在为不需要旗舰模型的问题, 付旗舰模型的价格

  • 大材小用

    客服流量里,八成是「怎么退货」「营业时间到几点」这种简单问题——但每一题,你都付了顶级模型的价格。

  • 选了就不动

    工程师上线时帮每个功能选定一个模型,之后没人回头调整。任务千变万化,模型却永远只有一个。

  • 追不上的更新

    模型市场每个月都在变,上个月的最佳性价比,这个月可能已经被超越。靠人工追,追不完。

问题不是模型不够好, 是分配不够聪明。

运作原理

三步骤,自动完成

1

Step 1

照常调用

代码一行都不用改。在管理界面建立一把附带智能路由的 API Key,替换原本的 Key,照原本的格式发送请求。

python 只换一把 Key
client = OpenAI(
  api_key="sk-your-current-key",
  api_key="sk-smart-routing-key",
  base_url="https://api.mixroute.ai/v1"
)
# request format unchanged
2

Step 2

实时判读

自研路由模型实时读取请求,判断复杂度与任务类型。判读模型支持 1M token 上下文——再长的请求也能完整判读。只读取、不存储:内容仅在内存中实时处理,判读完成立即清除,与 MixRoute 零数据留存政策完全一致。

判读内容 复杂度 × 任务类型
上下文支持 1M tokens
处理位置 仅内存,实时处理
判读后 立即清除
数据留存
3

Step 3

最适分配

从你授权的模型池中,选出最适合这个请求的模型。你的完整上下文原封穿透——不改写、不压缩、不截断,回答仍由真实模型产生。

gemini-3.5-flash 待命
claude-sonnet-5 本次最适
deepseek-v3.2 待命
gpt-5.6-sol 待命

完整上下文原封穿透,回答由真实模型产生

主导权

AI 负责调度, 你掌握边界

全自动的黑箱路由,把「用哪个模型」的决定权从你手上拿走。MixRoute 的做法相反:智能路由只在你划定的边界内运作。

模型池自定义

在管理界面为每一把 Key 独立设定模型池——哪些模型端点可以被派,由你决定。只放你信任的、合规的、预算内的模型。

限制由你设

为每把 Key 设定使用限制,超出即挡。不会有失控的请求,也不会有失控的账单。

节省看得见

内置节省仪表盘:智能路由帮你省了多少,一目了然。不是我们说了算,是数字说了算。

Model pool sk-…prod-router
  • claude-sonnet-5
  • gpt-5.6-sol
  • gpt-5-mini
  • gemini-3.5-flash
  • deepseek-v3.2
  • grok-4
节省仪表盘 本月

智能路由已为你省下

US$1,284

节省率 31.4%
实际支出
省下的

示意画面

实测数据

上万次实测的结果

我们以上万次真实任务测试智能路由的分配决策,平均节省 20–40% 的 API 成本。实际幅度依你模型池内的厂商组合而异——这也是为什么我们给你的是实测区间,不是营销口号。

算算你能省多少

每月 API 花费
US$500 US$50,000

预估每月可省

以上万次实测之平均节省区间估算,实际依模型池组合而异。

使用情境

什么样的团队最有感

  • 情境一

    高流量客服机器人

    大量重复、简单的问题,是智能路由最大的节省来源。简单题走轻量模型,疑难题自动升级,客人感觉不到差别,账单看得到差别。

    节省空间最大
  • 情境二

    内部知识助理

    查规章、找文件、摘要会议——多数请求不需要旗舰模型,但偶尔的深度分析需要。路由自动分辨,你不用教。

    自动分辨深浅
  • 情境三

    混合负载的 AI 产品

    使用者会问什么无法预测,简单与复杂交错出现。与其全部押注一个模型,不如让每个请求各得其所。

    各得其所
  • 情境四

    程序开发助手

    补全程序代码、写个小函数,轻量模型又快又省;跨文件重构、疑难除错,自动升级旗舰。工程师专心写程序,选模型的事交给路由。

    轻重自动切换

定价

先试用,再决定

US$0

限时免费

限时开放:现在开通,智能路由完全免费。用你的真实流量验证节省效果——仪表盘上的数字会告诉你答案。

5%

之后每笔 5%

试用期后,仅对「经过智能路由」的请求收取该笔请求金额 5% 的服务费。走一般 Key 的请求,不收。

一句话的算术

付出 5%。平均省下 20–40%

省下的远大于付出的——这就是它存在的理由。

FAQ

常见问题解答

是的,这会增加一个额外的评估步骤,所需时间取决于请求的长度。这是一种权衡:牺牲一点时间,以节省 20–40% 的成本。对于对延迟极其敏感的端点,您可以改用常规密钥直接连接到特定模型,从而绕过路由。

该分类模型仅读取数据,不进行存储。请求内容完全在内存中实时进行分类;处理完成后,数据会立即被清除,并以原样传递给目标模型,不会写入任何持久化存储——这符合 MixRoute 的“零数据留存”政策。

模型池是您的安全保障:路由功能始终仅从您授权的模型中进行选择,绝不会将流量分配给池外的任何模型。如果某些流量必须始终使用特定的模型,只需为其创建一个单独的通用密钥,即可实现直接连接。

三个字:主导权。大多数自动化路由解决方案都是彻头彻尾的“黑匣子”——一切由平台决定。MixRoute 的智能路由功能在您的自定义模型池内运行,结合零数据留存和节省成本的仪表盘,让您随时掌握成本节约的具体环节以及数据流向。

不。只需在管理界面中创建一个启用了智能路由功能的 API 密钥,并用它替换原有的密钥即可;API 调用格式完全保持不变。

限时免费试用。免费试用期结束后,仅对通过智能路由转发的请求收取 5% 的服务费;该费用将从您的预付余额中扣除,且计费过程透明且可核查。