コンテンツへスキップ

モデル詳細

rerank-v4.0-pro

Cohere 提供
従量課金 動的料金

CohereのAI検索基盤モデルは、検索システムおよびRAGシステム内で表示される情報の関連性を向上させるためのものです。32Kコンテキストウィンドウ、100+言語にわたる多言語サポート、データ前処理不要、低遅延による最先端のパフォーマンスを特長としています。

モデル仕様

コンテキスト長
32K
最大出力
–
入出力モダリティ
テキスト
リリース
2026-04

02

API エンドポイント

MixRoute 単一ゲートウェイ、OpenAI 互換

  • OpenAI-compatible /v1/chat/completions POST

03

段階料金

単位: /1M Tokens

ティア
base

05

選定サマリー

ワークロード適合性を素早く判断

このモデルは何に向いていますか?

モデル、入出力はテキスト

rerank-v4.0-pro はモデルです。仕様は、context window は 32,000 トークン。

使う前に何を確認すべきですか?

32,000 context、出力上限は未公開

rerank-v4.0-pro の採用前に、料金・レート制限・可用性を確認し、代表的なトラフィックで試験運用してください。

なぜ MixRoute 経由で使うのですか?

1 つの MixRoute キーで rerank-v4.0-pro を呼び出し

1 つの MixRoute キーで rerank-v4.0-pro を呼び出せ、課金とルーティングは同じアカウントにまとまります。MixRoute は OpenAI 互換エンドポイント /v1/chat/completions で rerank-v4.0-pro を提供します。既存のクライアントは https://api.mixroute.ai/v1 とモデル ID rerank-v4.0-pro に切り替えて、結合テストを再実行するだけです。

09

FAQ

本番トラフィックをrerank-v4.0-proに移行する前に、コンテキストとトークンの制限、価格行、現在のカタログステータス(安定)を確認してください。レコードには32,000トークンのコンテキストウィンドウが記載されています。これらの制限に合わせてワークロードのサイズを調整してください。

単一エンドポイントで検証可能な判断

同じリクエスト形式でこのモデルと代替ルートをテスト

実際のワークロードから始め、品質、総コスト、障害条件を基に本番トラフィックを送るか判断します。