コンテンツへスキップ

モデル詳細

gemini-3.1-flash-lite-preview

Google 提供
従量課金

Gemini 3.1 Flash Lite Preview is Google's high-efficiency model optimized for high-volume use cases. It outperforms Gemini 2.5 Flash Lite on overall quality and approaches Gemini 2.5 Flash performance across key capabilities. Improvements span audio input/ASR, RAG snippet ranking, translation, data extraction, and code completion. Supports full thinking levels (minimal, low, medium, high) for fine-grained cost/performance trade-offs. Priced at half the cost of Gemini 3 Flash.

モデル仕様

コンテキスト長
最大出力
入出力モダリティ
リリース
2026-03

02

API エンドポイント

MixRoute 単一ゲートウェイ、OpenAI 互換

  • Gemini /v1beta/models/{model}:generateContent POST
  • OpenAI-compatible /v1/chat/completions POST

03

料金

固定料金、単位: /1M Tokens

入力

$0.2500 /1M Tokens

生成

$1.5000 /1M Tokens

08

トークンコスト見積もり

このページの料金に基づく見積もりで、実請求ではありません

このモデルにはキャッシュ読み取り価格がないため、キャッシュ料金は計算されません

単一エンドポイントで検証可能な判断

同じリクエスト形式でこのモデルと代替ルートをテスト

実際のワークロードから始め、品質、総コスト、障害条件を基に本番トラフィックを送るか判断します。