Gemini 2.5 Flash Lite
Google 面向低延遲與高吞吐、成本敏感場景的 Gemini 模型。
上下文窗口
1,048,576
Gemini 2.5 Flash Lite
最大輸出
65,535
1M tokens
輸入
$0.10
輸出
$0.40
gemini-2.5-flash-lite試玩區
gemini-2.5-flash-lite暫無輸出
定價
| 方案 | 上下文窗口 | 最大輸出 | 輸入 | 輸出 | 緩存寫入 | 緩存讀取 |
|---|---|---|---|---|---|---|
Gemini 2.5 Flash Lite | 1,048,576 | 65,535 | $0.10 | $0.40 | - | $0.01 |
這裏展示的是 Vertex AI 按量計費下文本、圖片、視頻輸入的官方價格。
音頻輸入單價爲每 100 萬 tokens $0.30,緩存音頻輸入爲 $0.03。
緩存讀取或緩存輸入價格適用於複用的提示詞 tokens。
README
- Google 將 Gemini 2.5 Flash Lite 描述爲爲低延遲場景優化的平衡型模型。
- 它保留了 Gemini 2.5 的關鍵能力,包括多模態輸入、Google Search grounding、代碼執行和 100 萬 tokens 上下文。
- 它非常適合高併發助手、模型路由層、後臺自動化等更看重吞吐和成本而非極限推理深度的場景。
API
API
端點
POST /v1beta/models/{model}:generateContent認證
x-goog-api-key: YOUR_REACH_API_KEY Content-Type: application/json
示例
curl -X POST "https://direct.reachapi.ai/v1beta/models/YOUR_MODEL_ID:generateContent" \
-H "x-goog-api-key: YOUR_REACH_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [
{
"role": "user",
"parts": [
{
"text": "Introduce ReachAPI in one sentence."
}
]
}
],
"generationConfig": {
"temperature": 0.2
}
}'相關模型
Gemini 3.1 Flash Image Preview
Google's high-efficiency preview image model for fast generation, conversational editing, and grounded visual workflows.
Gemini 3.1 Pro Preview
Google's preview model for the most complex reasoning and agentic workflows.
Gemini 3 Pro Image Preview
Google's highest-quality preview image model for professional asset generation, editing, and grounded visual production.
Gemini 2.5 Flash
Google's price-performance Gemini model for balanced, multimodal production workloads.
Gemini 2.5 Flash Image
Google's high-velocity native image model for low-latency generation and conversational editing.
Gemini 2.5 Pro
Google's most advanced reasoning Gemini model for complex multimodal problem solving.
