Skip to main content
DeepSeek-V4-Flash

DeepSeek-V4-Flash

DeepSeek 的高速 V4 模型,适合注重成本的 OpenAI 兼容文本和推理工作负载。

快速成本高效OpenAI 兼容

上下文窗口

1M

Tokens

最大输出

384K

Tokens

模型代码deepseek-v4-flash

试玩区

deepseek-v4-flash

暂无输出

定价

方案上下文窗口最大输出输入输出缓存写入缓存读取
deepseek-v4-flash
1M tokens--
$0.28

1M tokens

-
$0.0028

1M tokens

Cache Miss Input · $0.14 · 1M tokens

缓存读取或缓存输入价格适用于复用的提示词 tokens。

README

DeepSeek-V4-Flash 是 DeepSeek V4 系列中更偏成本效率的选择,适合需要快速响应、实用推理和低 token 成本的企业团队。
  • DeepSeek-V4-Flash 适合高并发助手、模型路由层、信息抽取和对延迟敏感的工作流,尤其适合需要控制成本的场景。
  • OpenAI 兼容聊天接口方便团队在既有 API 网关、SDK 和可观测性链路后接入该模型。
  • 对于固定系统提示词、检索包装和策略上下文较多的企业应用,缓存命中价格可以显著改善重复上下文成本。

API

查看 API 文档以获取请求格式、参数说明和集成方式。

DeepSeek 的高速 V4 模型,适合注重成本的 OpenAI 兼容文本和推理工作负载。

模型代码

deepseek-v4-flash

查看 API 文档

API

端点

POST /v1/messages

认证

Authorization: Bearer YOUR_REACH_API_KEY
anthropic-version: 2023-06-01
Content-Type: application/json

示例

curl -X POST "https://direct.reachapi.ai/v1/messages" \
  -H "Authorization: Bearer YOUR_REACH_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "YOUR_MODEL_ID",
    "messages": [
      {
        "role": "user",
        "content": "Introduce ReachAPI in one sentence."
      }
    ],
    "max_tokens": 512,
    "temperature": 0.2
  }'