模型详情
rerank-v4.0-pro
按量付费
动态计价
Cohere 的 AI 搜索基础模型旨在提升搜索和 RAG 系统中呈现信息的关联性。该模型具有 32K 个 context window,支持 100+ 种语言,无需数据预处理,并拥有低延迟的卓越性能。
模型规格
- 上下文长度
- 32K
- 最大输出
- –
- 输入/输出模态
- 文本
- 发布日期
- 2026-04
02
API 端点
单一 MixRoute 网关,OpenAI 兼容
-
OpenAI-compatible
/v1/chat/completionsPOST
03
阶梯价格
单位:/1M Tokens
| 档位 |
|---|
| base |
05
选型摘要
快速判断是否适合你的工作负载
这个模型适合什么?
模型,输入输出包含文本
rerank-v4.0-pro 是模型。规格上,context window 为 32,000 个 Token。
使用前应检查什么?
32,000 context,输出上限未公布
采用 rerank-v4.0-pro 前,先确认费率、速率上限与可用性,并以具有代表性的流量试跑。
为什么通过 MixRoute 使用?
一个 MixRoute 密钥即可调用 rerank-v4.0-pro
一个 MixRoute 密钥即可调用 rerank-v4.0-pro,计费与路由与其他模型同账号。MixRoute 以 OpenAI 兼容端点 /v1/chat/completions 提供 rerank-v4.0-pro;既有客户端只需指向 https://api.mixroute.ai/v1 并把模型 ID 换成 rerank-v4.0-pro,再跑一次集成测试即可。
09
FAQ
在将生产流量迁移到 rerank-v4.0-pro 之前,请确认其 context 和 Token 限制、价格行以及当前目录状态(稳定)。该记录列出了一个 32,000 Token context window;请根据这些限制调整工作负载。
单一端点,可验证的决策
使用相同的请求格式测试此模型和备用路由
从真实工作负载开始,再由质量、总成本和故障条件决定是否接入生产流量。