Skip to main content
Gemini 2.5 Flash Lite

Gemini 2.5 Flash Lite

Google 面向低延遲與高吞吐、成本敏感場景的 Gemini 模型。

低延遲高吞吐成本敏感

上下文窗口

1,048,576

Gemini 2.5 Flash Lite

最大輸出

65,535

1M tokens

輸入

$0.10

輸出

$0.40

模型代碼gemini-2.5-flash-lite

試玩區

gemini-2.5-flash-lite

暫無輸出

定價

方案上下文窗口最大輸出輸入輸出緩存寫入緩存讀取
Gemini 2.5 Flash Lite
1,048,57665,535
$0.10
$0.40
-
$0.01

這裏展示的是 Vertex AI 按量計費下文本、圖片、視頻輸入的官方價格。

音頻輸入單價爲每 100 萬 tokens $0.30,緩存音頻輸入爲 $0.03。

緩存讀取或緩存輸入價格適用於複用的提示詞 tokens。

README

Gemini 2.5 Flash Lite 是 Google 的輕量 2.5 系列模型,重點優化低延遲和更低成本,同時保留 Gemini 2.5 家族的多模態和工具使用基礎能力。
  • Google 將 Gemini 2.5 Flash Lite 描述爲爲低延遲場景優化的平衡型模型。
  • 它保留了 Gemini 2.5 的關鍵能力,包括多模態輸入、Google Search grounding、代碼執行和 100 萬 tokens 上下文。
  • 它非常適合高併發助手、模型路由層、後臺自動化等更看重吞吐和成本而非極限推理深度的場景。

API

查看 API 文檔以獲取請求格式、參數說明和集成方式。

Google 面向低延遲與高吞吐、成本敏感場景的 Gemini 模型。

模型代碼

gemini-2.5-flash-lite

查看 API 文檔

API

端點

POST /v1beta/models/{model}:generateContent

認證

x-goog-api-key: YOUR_REACH_API_KEY
Content-Type: application/json

示例

curl -X POST "https://direct.reachapi.ai/v1beta/models/YOUR_MODEL_ID:generateContent" \
  -H "x-goog-api-key: YOUR_REACH_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [
      {
        "role": "user",
        "parts": [
          {
            "text": "Introduce ReachAPI in one sentence."
          }
        ]
      }
    ],
    "generationConfig": {
      "temperature": 0.2
    }
  }'