跳至内容

智能路由

这款 AI 网关可将你的账单 降低 20–40%

MixRoute 智能路由通过自研 AI 模型实时分析每个请求,判断其复杂度与任务类型,再将请求发送至你授权模型池中最适合的模型。

上万次实测
上万次实测
平均节省 20–40%
平均节省 20–40%
限时免费
限时免费
零数据留存
零数据留存
怎么退货? 摘要这份会议记录 营业时间到几点? 重构整个交易模块
智能路由 实时判读
简单 Gemini 复杂 Claude 超复杂 GPT
路由决策示意

实测数据

上万次实测的结果

我们以上万次真实任务测试智能路由的分配决策,平均节省 20–40% 的 API 成本。实际幅度依你模型池内的厂商组合而异——这也是为什么我们给你的是实测区间,不是营销口号。

算算你能省多少

每月 API 花费 US$5,000
US$500 US$50,000

预估每月可省

以上万次实测之平均节省区间估算,实际依模型池组合而异。

你正在为不需要旗舰模型的问题, 付旗舰模型的价格

大材小用

客服流量里,八成是「怎么退货」「营业时间到几点」这种简单问题——但每一题,你都付了顶级模型的价格。

选了就不动

工程师上线时帮每个功能选定一个模型,之后没人回头调整。任务千变万化,模型却永远只有一个。

追不上的更新

模型市场每个月都在变,上个月的最佳性价比,这个月可能已经被超越。靠人工追,追不完。

问题不是模型不够好, 是分配不够聪明。

运作原理

三步骤,自动完成

1

Step 1

照常调用

代码一行都不用改。在管理界面建立一把附带智能路由的 API Key,替换原本的 Key,照原本的格式发送请求。

python 只换一把 Key
client = OpenAI(api_key="sk-your-current-key",api_key="sk-smart-routing-key",base_url="https://api.mixroute.ai/v1")# request format unchanged
2

Step 2

实时判读

自研路由模型实时读取请求,判断复杂度与任务类型。判读模型支持 1M token 上下文——再长的请求也能完整判读。只读取、不存储:内容仅在内存中实时处理,判读完成立即清除,与 MixRoute 零数据留存政策完全一致。

判读内容
复杂度 × 任务类型
上下文支持
1M tokens
处理位置
仅内存,实时处理
判读后
立即清除
数据留存
3

Step 3

最适分配

从你授权的模型池中,选出最适合这个请求的模型。你的完整上下文原封穿透——不改写、不压缩、不截断,回答仍由真实模型产生。

  • gemini-3.5-flash 待命
  • claude-sonnet-5 本次最适
  • deepseek-v3.2 待命
  • gpt-5.6-sol 待命

完整上下文原封穿透,回答由真实模型产生

主导权

AI 负责调度, 你掌握边界

完全自动,但绝非黑箱。智能路由始终只在你设定的边界内运行:你授权的模型池、你设置的限制,以及你看得见的节省。

模型池由你决定

在控制台中为每个 API 密钥配置独立的模型池。可分配哪些模型端点,完全由你决定。

限制由你设

为每个 API 密钥设置使用限制,超出部分会被拦截。不会有失控的请求,也不会有失控的账单。

节省看得见

内置节省仪表盘会准确显示智能路由为你节省了多少。不是我们说了算,而是你的数据。

模型池 sk-…prod-router
简单 轻量模型 Google

适用于大批量轻量请求:分类、提取和常见问题。

复杂 核心模型 Anthropic

多步骤推理、代码和长篇分析。

超复杂 旗舰模型 OpenAI

适用于最深度的推理和关键决策任务。

节省仪表盘 本月

智能路由已为你省下

US$1,284

节省率 31.4%
实际支出 省下的

示意画面

使用情境

什么样的团队最有感

情境一

高流量客服机器人

大量重复、简单的问题,是智能路由最大的节省来源。简单题走轻量模型,疑难题自动升级,客人感觉不到差别,账单看得到差别。

节省空间最大

情境二

内部知识助理

查规章、找文件、摘要会议——多数请求不需要旗舰模型,但偶尔的深度分析需要。路由自动分辨,你不用教。

自动分辨深浅

情境三

混合负载的 AI 产品

使用者会问什么无法预测,简单与复杂交错出现。与其全部押注一个模型,不如让每个请求各得其所。

各得其所

情境四

程序开发助手

补全程序代码、写个小函数,轻量模型又快又省;跨文件重构、疑难除错,自动升级旗舰。工程师专心写程序,选模型的事交给路由。

轻重自动切换

定价

先试用,再决定

US$0

限时免费

限时开放:现在开通,智能路由完全免费。用你的真实流量验证节省效果——仪表盘上的数字会告诉你答案。

5%

之后每笔 5%

试用期后,仅对「经过智能路由」的请求收取该笔请求金额 5% 的服务费。走一般 Key 的请求,不收。

一句话的算术

付出5%。平均省下20–40%

省下的远大于付出的——这就是它存在的理由。

FAQ

常见问题解答

智能路由会增加延迟吗?

是的,这会增加一个额外的评估步骤,所需时间取决于请求的长度。这是一种权衡:牺牲一点时间,以节省 20–40% 的成本。对于对延迟极其敏感的端点,您可以改用常规密钥直接连接到特定模型,从而绕过路由。

路由模型能看到我的数据吗?

该分类模型仅读取数据,不进行存储。请求内容完全在内存中实时进行分类;处理完成后,数据会立即被清除,并以原样传递给目标模型,不会写入任何持久化存储——这符合 MixRoute 的“零数据留存”政策。

如果路由器出错了怎么办?我能强制它使用特定模型吗?

模型池是您的安全保障:路由功能始终仅从您授权的模型中进行选择,绝不会将流量分配给池外的任何模型。如果某些流量必须始终使用特定的模型,只需为其创建一个单独的通用密钥,即可实现直接连接。

这与其他平台上的自动路由功能有什么不同?

三个字:主导权。大多数自动化路由解决方案都是彻头彻尾的“黑匣子”——一切由平台决定。MixRoute 的智能路由功能在您的自定义模型池内运行,结合零数据留存和节省成本的仪表盘,让您随时掌握成本节约的具体环节以及数据流向。

我需要修改代码吗?

不。只需在管理界面中创建一个启用了智能路由功能的 API 密钥,并用它替换原有的密钥即可;API 调用格式完全保持不变。

这要多少钱?

限时免费试用。免费试用期结束后,仅对通过智能路由转发的请求收取 5% 的服务费;该费用将从您的预付余额中扣除,且计费过程透明且可核查。

开始让每一块钱, 花在刀口上

限时免费,仪表盘见真章。

联系销售