跳至内容

模型详情

rerank-v4.0-pro

由 Cohere 提供
按量付费 动态计价

Cohere 的 AI 搜索基础模型旨在提升搜索和 RAG 系统中呈现信息的关联性。该模型具有 32K 个 context window,支持 100+ 种语言,无需数据预处理,并拥有低延迟的卓越性能。

模型规格

上下文长度
32K
最大输出
–
输入/输出模态
文本
发布日期
2026-04

02

API 端点

单一 MixRoute 网关,OpenAI 兼容

  • OpenAI-compatible /v1/chat/completions POST

03

阶梯价格

单位:/1M Tokens

档位
base

05

选型摘要

快速判断是否适合你的工作负载

这个模型适合什么?

模型,输入输出包含文本

rerank-v4.0-pro 是模型。规格上,context window 为 32,000 个 Token。

使用前应检查什么?

32,000 context,输出上限未公布

采用 rerank-v4.0-pro 前,先确认费率、速率上限与可用性,并以具有代表性的流量试跑。

为什么通过 MixRoute 使用?

一个 MixRoute 密钥即可调用 rerank-v4.0-pro

一个 MixRoute 密钥即可调用 rerank-v4.0-pro,计费与路由与其他模型同账号。MixRoute 以 OpenAI 兼容端点 /v1/chat/completions 提供 rerank-v4.0-pro;既有客户端只需指向 https://api.mixroute.ai/v1 并把模型 ID 换成 rerank-v4.0-pro,再跑一次集成测试即可。

09

FAQ

在将生产流量迁移到 rerank-v4.0-pro 之前,请确认其 context 和 Token 限制、价格行以及当前目录状态(稳定)。该记录列出了一个 32,000 Token context window;请根据这些限制调整工作负载。

单一端点,可验证的决策

使用相同的请求格式测试此模型和备用路由

从真实工作负载开始,再由质量、总成本和故障条件决定是否接入生产流量。