智东西
作者 | 王涵
编辑 | 冰倩
7月31日,DeepSeek-V4-Flash正式版API正式开启公测。紧随其后,DeepSeek-V4-Pro正式版预计于8月初登场。从DeepSeek V4预览版发布至今,历时已逾三个月。
新版Flash采用MoE架构,总参数量高达284B,激活参数为13B。它支持长达100万token的上下文窗口,并可自由切换非思考与思考模式。在模型结构与尺寸上,Flash正式版沿用了V4-Flash-preview的配置,主要差异在于完成了重新后训练。
针对主流Agent产品如Claude Code、OpenClaw、OpenCode及CodeBuddy,DeepSeek V4预览版此前已完成适配优化。Flash正式版则原生兼容OpenAI的Responses API格式,并对Codex进行了针对性适配。这意味着开发者无需修改Base URL,即可直接切换模型。
根据DeepSeek官方API文档,DeepSeek-V4-Flash在Agent能力上实现了显著跃升,基准测试成绩亮眼:
4月24日,DeepSeek开源了DeepSeek-V4系列预览版本。其中,DeepSeek-V4-Pro聚焦性能上限,对标闭源旗舰;而DeepSeek-V4-Flash通过大幅缩减参数与激活规模,换取更低的延迟与成本优势。
评测显示,DeepSeek-V4-Pro-Preview在Agentic Coding等项目中跻身开源第一梯队。内部测试表明,其交付质量在非思考模式下已逼近Claude Opus 4.6,但与后者开启思考模式相比仍有差距。
在数学、STEM领域及竞赛级代码等高难度任务中,DeepSeek-V4-Pro-Preview的表现超越了目前公开评测中的多数开源模型,整体实力接近甚至持平GPT-5.4、Claude Opus 4.6-Max等顶尖闭源模型。
长上下文效率方面,DeepSeek-V4采取了更为激进的优化策略。在100万token场景下,单token推理计算量仅为V3.2的27%,KV Cache占用率降至约10%。这一改进大幅削减了长链路任务的算力与显存开销。
定价方面,DeepSeek-V4-Pro在输入命中缓存时价格为1元/百万tokens,未命中则为12元/百万tokens,输出费用为24元/百万tokens。相比之下,DeepSeek-V4-Flash更具性价比:输入命中缓存仅0.2元/百万tokens,未命中为1元/百万tokens,输出为2元/百万tokens。
结语:价格战拼的是入场券,Agent能力才是决赛圈
今日,OpenAI宣布GPT-5.6 Luna降价80%,Terra降价20%。业内普遍将此解读为国产大模型低价策略倒逼的结果。经过多轮价格博弈,API调用成本似乎已不再是开发者选择模型的关键门槛,真正稀缺的是具备实际交付能力的Agent。
过去半年间,国产厂商在保持价格优势的同时,正全力补齐Agent与Coding领域的短板。DeepSeek-V4-Flash正式版的Agent能力全面超越此前的Pro预览版,以更低的价格提供了更强的实战效能,有力证明了低价并不等同于低能。
对于开发者而言,价格战比拼的是入局门槛,而模型的Agent能力角逐的,才是智能发展的天花板。
















