モデル詳細
rerank-v4.0-pro
CohereのAI検索基盤モデルは、検索システムおよびRAGシステム内で表示される情報の関連性を向上させるためのものです。32Kコンテキストウィンドウ、100+言語にわたる多言語サポート、データ前処理不要、低遅延による最先端のパフォーマンスを特長としています。
モデル仕様
- コンテキスト長
- 32K
- 最大出力
- –
- 入出力モダリティ
- テキスト
- リリース
- 2026-04
02
API エンドポイント
MixRoute 単一ゲートウェイ、OpenAI 互換
-
OpenAI-compatible
/v1/chat/completionsPOST
03
段階料金
単位: /1M Tokens
| ティア |
|---|
| base |
05
選定サマリー
ワークロード適合性を素早く判断
このモデルは何に向いていますか?
モデル、入出力はテキスト
rerank-v4.0-pro はモデルです。仕様は、context window は 32,000 トークン。
使う前に何を確認すべきですか?
32,000 context、出力上限は未公開
rerank-v4.0-pro の採用前に、料金・レート制限・可用性を確認し、代表的なトラフィックで試験運用してください。
なぜ MixRoute 経由で使うのですか?
1 つの MixRoute キーで rerank-v4.0-pro を呼び出し
1 つの MixRoute キーで rerank-v4.0-pro を呼び出せ、課金とルーティングは同じアカウントにまとまります。MixRoute は OpenAI 互換エンドポイント /v1/chat/completions で rerank-v4.0-pro を提供します。既存のクライアントは https://api.mixroute.ai/v1 とモデル ID rerank-v4.0-pro に切り替えて、結合テストを再実行するだけです。
09
FAQ
本番トラフィックをrerank-v4.0-proに移行する前に、コンテキストとトークンの制限、価格行、現在のカタログステータス(安定)を確認してください。レコードには32,000トークンのコンテキストウィンドウが記載されています。これらの制限に合わせてワークロードのサイズを調整してください。
単一エンドポイントで検証可能な判断
同じリクエスト形式でこのモデルと代替ルートをテスト
実際のワークロードから始め、品質、総コスト、障害条件を基に本番トラフィックを送るか判断します。