DeepSeek-V4-Flash
DeepSeek 的高速 V4 模型,适合注重成本的 OpenAI 兼容文本和推理工作负载。
快速成本高效OpenAI 兼容
上下文窗口
1M
Tokens
最大输出
384K
Tokens
模型代码
deepseek-v4-flash试玩区
deepseek-v4-flash暂无输出
定价
| 方案 | 上下文窗口 | 最大输出 | 输入 | 输出 | 缓存写入 | 缓存读取 |
|---|---|---|---|---|---|---|
deepseek-v4-flash | 1M tokens | - | - | $0.28 1M tokens | - | $0.0028 1M tokens |
Cache Miss Input · $0.14 · 1M tokens
缓存读取或缓存输入价格适用于复用的提示词 tokens。
README
DeepSeek-V4-Flash 是 DeepSeek V4 系列中更偏成本效率的选择,适合需要快速响应、实用推理和低 token 成本的企业团队。
- DeepSeek-V4-Flash 适合高并发助手、模型路由层、信息抽取和对延迟敏感的工作流,尤其适合需要控制成本的场景。
- OpenAI 兼容聊天接口方便团队在既有 API 网关、SDK 和可观测性链路后接入该模型。
- 对于固定系统提示词、检索包装和策略上下文较多的企业应用,缓存命中价格可以显著改善重复上下文成本。
API
查看 API 文档以获取请求格式、参数说明和集成方式。
API
端点
POST /v1/messages认证
Authorization: Bearer YOUR_REACH_API_KEY anthropic-version: 2023-06-01 Content-Type: application/json
示例
curl -X POST "https://direct.reachapi.ai/v1/messages" \
-H "Authorization: Bearer YOUR_REACH_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "YOUR_MODEL_ID",
"messages": [
{
"role": "user",
"content": "Introduce ReachAPI in one sentence."
}
],
"max_tokens": 512,
"temperature": 0.2
}'相关模型
同一厂商的其他模型
GLM-5.3
Z.AI's GLM-5.3 flagship model for coding, reasoning, and agentic workloads.
GLM-5.3-Flash
Z.AI's faster, lower-cost model for coding, agentic, and multimodal workloads.
GLM-5.2
Z.AI's GLM-5.2 model for enterprise text generation, reasoning, and OpenAI-compatible API workloads.
DeepSeek-V4-Pro
DeepSeek's stronger V4 model for OpenAI-compatible reasoning, coding, and enterprise text workloads.
Kimi K3
Kimi's flagship reasoning model for long-horizon coding, visual understanding, and end-to-end knowledge work.
