Kimi K3
Kimi 面向長程編程、視覺理解與端到端知識工作的旗艦推理模型。
100 萬上下文原生視覺智能體工具調用
上下文窗口
1,048,576 tokens
kimi-k3
最大輸出
1,048,576 tokens
1M tokens
輸入
-
輸出
$13.5$15
10% off1M tokens
模型代碼
kimi-k3試玩區
kimi-k3參考圖片0/5
Click or drag
暫無輸出
定價
| 方案 | 上下文窗口 | 最大輸出 | 輸入 | 輸出 | 緩存寫入 | 緩存讀取 |
|---|---|---|---|---|---|---|
kimi-k3 | 1,048,576 tokens | 1,048,576 tokens | - | $13.5$1510% off 1M tokens | - | $0.27$0.3010% off 1M tokens |
Cache Miss Input · $2.7 · 1M tokens
緩存讀取或緩存輸入價格適用於複用的提示詞 tokens。
README
Kimi K3 是 Kimi 迄今能力最強的旗艦模型,結合始終開啟的推理、原生視覺理解、100 萬 Token 上下文和高級工具調用能力,面向長程編程與知識工作。
- Kimi K3 是擁有 2.8 萬億參數的旗艦模型,面向長程編程、端到端知識工作、推理,以及將軟件工程與視覺反饋相結合的工作流。
- 該模型原生支持視覺理解,擁有 1,048,576 Token 上下文窗口;針對超長推理或生成任務,最大完成長度可配置至 1,048,576 tokens。
- Kimi K3 始終進行推理,支持 low、high 和 max 三檔推理強度,默認使用 max。它還支持自動上下文緩存、工具調用、工具調用約束、動態工具加載、JSON Mode、嚴格結構化輸出、Partial Mode 和流式輸出。
API
查看 API 文檔以獲取請求格式、參數說明和集成方式。
API
端點
POST /v1/messages認證
Authorization: Bearer YOUR_REACH_API_KEY anthropic-version: 2023-06-01 Content-Type: application/json
示例
curl -X POST "https://direct.reachapi.ai/v1/messages" \
-H "Authorization: Bearer YOUR_REACH_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "YOUR_MODEL_ID",
"messages": [
{
"role": "user",
"content": "Introduce ReachAPI in one sentence."
}
],
"max_tokens": 512,
"temperature": 0.2
}'相關模型
同一廠商的其他模型
GLM-5.2
Z.AI's GLM-5.2 model for enterprise text generation, reasoning, and OpenAI-compatible API workloads.
DeepSeek-V4-Flash
DeepSeek's fast V4 model for cost-sensitive, OpenAI-compatible text and reasoning workloads.
DeepSeek-V4-Pro
DeepSeek's stronger V4 model for OpenAI-compatible reasoning, coding, and enterprise text workloads.
