Kimi K3
Kimi 面向长程编程、视觉理解与端到端知识工作的旗舰推理模型。
100 万上下文原生视觉智能体工具调用
上下文窗口
1,048,576 tokens
kimi-k3
最大输出
1,048,576 tokens
1M tokens
输入
-
输出
$13.5$15
10% off1M tokens
模型代码
kimi-k3试玩区
kimi-k3参考图片0/5
Click or drag
暂无输出
定价
| 方案 | 上下文窗口 | 最大输出 | 输入 | 输出 | 缓存写入 | 缓存读取 |
|---|---|---|---|---|---|---|
kimi-k3 | 1,048,576 tokens | 1,048,576 tokens | - | $13.5$1510% off 1M tokens | - | $0.27$0.3010% off 1M tokens |
Cache Miss Input · $2.7 · 1M tokens
缓存读取或缓存输入价格适用于复用的提示词 tokens。
README
Kimi K3 是 Kimi 迄今能力最强的旗舰模型,结合始终开启的推理、原生视觉理解、100 万 Token 上下文和高级工具调用能力,面向长程编程与知识工作。
- Kimi K3 是拥有 2.8 万亿参数的旗舰模型,面向长程编程、端到端知识工作、推理,以及将软件工程与视觉反馈相结合的工作流。
- 该模型原生支持视觉理解,拥有 1,048,576 Token 上下文窗口;针对超长推理或生成任务,最大完成长度可配置至 1,048,576 tokens。
- Kimi K3 始终进行推理,支持 low、high 和 max 三档推理强度,默认使用 max。它还支持自动上下文缓存、工具调用、工具调用约束、动态工具加载、JSON Mode、严格结构化输出、Partial Mode 和流式输出。
API
查看 API 文档以获取请求格式、参数说明和集成方式。
API
端点
POST /v1/messages认证
Authorization: Bearer YOUR_REACH_API_KEY anthropic-version: 2023-06-01 Content-Type: application/json
示例
curl -X POST "https://direct.reachapi.ai/v1/messages" \
-H "Authorization: Bearer YOUR_REACH_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "YOUR_MODEL_ID",
"messages": [
{
"role": "user",
"content": "Introduce ReachAPI in one sentence."
}
],
"max_tokens": 512,
"temperature": 0.2
}'相关模型
同一厂商的其他模型
GLM-5.3
Z.AI's GLM-5.3 flagship model for coding, reasoning, and agentic workloads.
GLM-5.3-Flash
Z.AI's faster, lower-cost model for coding, agentic, and multimodal workloads.
GLM-5.2
Z.AI's GLM-5.2 model for enterprise text generation, reasoning, and OpenAI-compatible API workloads.
DeepSeek-V4-Flash
DeepSeek's fast V4 model for cost-sensitive, OpenAI-compatible text and reasoning workloads.
DeepSeek-V4-Pro
DeepSeek's stronger V4 model for OpenAI-compatible reasoning, coding, and enterprise text workloads.
