Skip to main content
Gemini 2.5 Flash Lite

Gemini 2.5 Flash Lite

低レイテンシかつ高トラフィック運用向けに最適化された、Google の軽量 Gemini モデルです。

低レイテンシ高スループットコスト重視

コンテキストウィンドウ

1,048,576

Gemini 2.5 Flash Lite

最大出力

65,535

100万トークン

入力

$0.10

出力

$0.40

モデルコードgemini-2.5-flash-lite

プレイグラウンド

gemini-2.5-flash-lite

出力はまだありません

価格

プランコンテキストウィンドウ最大出力入力出力キャッシュ書き込みキャッシュ読み取り
Gemini 2.5 Flash Lite
1,048,57665,535
$0.10
$0.40
-
$0.01

Vertex AI の従量課金価格をもとに、テキスト・画像・動画入力の単価を掲載しています。

音声入力は 100万トークンあたり $0.30、キャッシュ済み音声入力は $0.03 で課金されます。

キャッシュ読み取りまたはキャッシュされた入力の料金は、再利用されたプロンプト トークンに適用されます。

解説

Gemini 2.5 Flash Lite は、Gemini 2.5 系のマルチモーダル入力やツール利用の基盤を維持しながら、より低いレイテンシと低コストに寄せた軽量モデルです。
  • Google は Gemini 2.5 Flash Lite を、低レイテンシ用途に向けたバランス型モデルとして位置付けています。
  • マルチモーダル入力、Google Search によるグラウンディング、コード実行、100万トークンのコンテキスト長といった Gemini 2.5 系の主要機能を維持しています。
  • 高トラフィックなアシスタント、ルーティング層、バックグラウンド自動化など、最先端性能よりも処理量とコスト効率が重要なワークロードに向いています。

API

リクエストの形式、パラメータ、統合の詳細については、API ドキュメントを使用してください。

低レイテンシかつ高トラフィック運用向けに最適化された、Google の軽量 Gemini モデルです。

モデルコード

gemini-2.5-flash-lite

API ドキュメントを表示する

API

エンドポイント

POST /v1beta/models/{model}:generateContent

認証

x-goog-api-key: YOUR_REACH_API_KEY
Content-Type: application/json

サンプル

curl -X POST "https://direct.reachapi.ai/v1beta/models/YOUR_MODEL_ID:generateContent" \
  -H "x-goog-api-key: YOUR_REACH_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [
      {
        "role": "user",
        "parts": [
          {
            "text": "Introduce ReachAPI in one sentence."
          }
        ]
      }
    ],
    "generationConfig": {
      "temperature": 0.2
    }
  }'