DeepSeek于7月31日把V4 Flash 0731作为公开测试版发布。公司称,新版保留了早期预览的架构和规模,同时增加新的训练后阶段。模型通过API开放,没有取代DeepSeek消费者应用、网页服务或API中的Pro模型。
DeepSeek文档显示,模型支持100万token上下文窗口,最大输出为384000 token,并包含Responses API和面向Codex的适配。这些规格为长文档和编程场景提供可能,但能够接收极大上下文,并不能说明模型能多有效地利用其中每一部分。
官方公布的每百万token价格为,缓存命中输入0.0028美元,缓存未命中输入0.14美元,输出0.28美元。缓存与非缓存输入差价巨大,因此工作负载形态成为比较的核心。以缓存命中为依据的醒目价格,无法描述反复发送新上下文的任务。
原始token价格也没有计入延迟、推理token、重试、失败调用和输出质量。如果任务需要多次修正,一个每token便宜的模型也可能在每个合格结果上成本很高。与GPT、Claude、Gemini或Kimi比较时,应使用相同输入,并披露缓存行为和完成标准。
由于产品仍是测试版,模型标识和价格可能变化。开发者应在部署前确认当前API条目,并让成本记录与日期绑定。可复现的单任务成本测试,比假设所有token都按最低价计费的发布表更持久。
接下来值得关注
应先确认当前测试版模型和价格,再衡量完整任务成本,并披露缓存率、延迟、重试、上下文使用和失败调用。
信息来源
这份回顾性发布档案于2026年8月3日根据DeepSeek更新、定价页和模型仓库整理,并参考Axios的市场报道。AI News of Today未进行API成本或质量测试。
我们尽可能链接原始文件,并采用一手采访资料。