DeepSeek V4 Flash API

通过 Wokey 调用 DeepSeek V4 Flash,查看带时间边界的目录价格、官方原生支持接口、上下文和模型能力。

模型 ID
deepseek-v4-flash
供应商
volcengine, deepseek
供应状态
当前可调用

目录价格快照

价格单位为每 100 万 tokens;实际结算以请求处理时价格为准。

计费项Wokey官方参考节省幅度
Input$0.176$0.2220%
Output$0.528$0.6620%
Cache read$0.0056$0.00720%
Cache write

价格检查时间:

官方价格来源: https://api-docs.deepseek.com/quick_start/pricing

模型能力

Context
1,000,000 tokens
最大输出
384,000 tokens
Streaming
支持
Tools
支持
Vision
支持接口
/v1/chat/completions

发送请求

/v1/chat/completions

curl https://api.wokey.ai/v1/chat/completions \
  -H "Authorization: Bearer $WOKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Hello"}]}'

常见问题

DeepSeek V4 Flash API 价格是多少?与官方 API 相比能节省多少?

截至 2026-08-26,Wokey 输入价为 $0.176 / 1M tokens,输出价为 $0.528 / 1M tokens;官方参考价分别为 $0.22 和 $0.66。输入较官方参考价低 20%,输出低 20%。实际结算以请求处理时价格为准,官方定价来源见本页链接。

DeepSeek V4 Flash 支持哪些 API 接口,如何通过 Wokey 调用?

DeepSeek V4 Flash 支持 /v1/chat/completions(Chat Completions 请求)。将 API Base URL 设为 https://api.wokey.ai,使用 Wokey API Key,并把模型 ID 设为 canonical ID deepseek-v4-flash;可先使用 /v1/chat/completions。本页“发送请求”部分提供了每一种支持接口的 curl 示例。

DeepSeek V4 Flash 的上下文窗口和最大输出是多少?

DeepSeek V4 Flash 的目录上下文窗口为 1,000,000 tokens,最大输出为 384,000 tokens。上下文窗口和最大输出是两个不同限制,实际请求还要满足处理时的上游约束。

DeepSeek V4 Flash 的缓存读取和缓存写入如何计费?

缓存读取:Wokey 为 $0.0056 / 1M tokens,官方参考为 $0.007 / 1M tokens。缓存写入:厂商未公布独立计费项,Wokey 公开价格也显示 —。

DeepSeek V4 Flash 和 DeepSeek V4 Pro 的价格与上下文有什么区别?

本次价格快照中,DeepSeek V4 Flash 的输入/输出价格为 $0.176 / $0.528,上下文窗口为 1,000,000 tokens;DeepSeek V4 Pro 分别为 $0.528 / $1.584 和 1,000,000 tokens。这是价格与容量的事实比较,不代表模型质量排序;选择时还应结合各自支持接口和能力。

相关模型与文档

获取 API Key · deepseek-v4-flash