Skip to main content
DeepSeek-V4-Flash

DeepSeek-V4-Flash

DeepSeek 的高速 V4 模型,適合注重成本的 OpenAI 相容文本和推理工作負載。

快速成本高效OpenAI 相容

上下文視窗

1M

Tokens

最大輸出

384K

Tokens

模型代碼deepseek-v4-flash

試玩區

deepseek-v4-flash

暫無輸出

定價

方案上下文窗口最大輸出輸入輸出緩存寫入緩存讀取
deepseek-v4-flash
1M tokens--
$0.28

1M tokens

-
$0.0028

1M tokens

Cache Miss Input · $0.14 · 1M tokens

緩存讀取或緩存輸入價格適用於複用的提示詞 tokens。

README

DeepSeek-V4-Flash 是 DeepSeek V4 系列中更偏成本效率的選擇,適合需要快速回應、實用推理和低 token 成本的企業團隊。
  • DeepSeek-V4-Flash 適合高併發助手、模型路由層、資訊抽取和對延遲敏感的工作流,尤其適合需要控制成本的場景。
  • OpenAI 相容聊天介面方便團隊在既有 API 閘道、SDK 和可觀測性鏈路後接入該模型。
  • 對於固定系統提示詞、檢索包裝和策略上下文較多的企業應用,快取命中價格可以顯著改善重複上下文成本。

API

查看 API 文檔以獲取請求格式、參數說明和集成方式。

DeepSeek 的高速 V4 模型,適合注重成本的 OpenAI 相容文本和推理工作負載。

模型代碼

deepseek-v4-flash

查看 API 文檔

API

端點

POST /v1/messages

認證

Authorization: Bearer YOUR_REACH_API_KEY
anthropic-version: 2023-06-01
Content-Type: application/json

示例

curl -X POST "https://direct.reachapi.ai/v1/messages" \
  -H "Authorization: Bearer YOUR_REACH_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "YOUR_MODEL_ID",
    "messages": [
      {
        "role": "user",
        "content": "Introduce ReachAPI in one sentence."
      }
    ],
    "max_tokens": 512,
    "temperature": 0.2
  }'