今天,2026年7月31日,DeepSeek-V4-Flash正式版API悄然上线公测。还是以往梁文锋低调的风格,没有发布会,没有预热,就这么静悄悄的推了出来。当然,这里还是要说明下,App和网页端暂时还没动静,只有API接口完成了升级。但别小看这次更新,它可能是近期国产大模型圈子里最值得关注的一件事。
这次升级的版本号是0731,模型结构、尺寸和之前的Preview版完全一致,总参数量284B,激活参数量13B,核心评测里,V4-Flash正式版已经超过了GLM-5.2,正在一步步逼近Claude Opus 4.8的水平。
有个细节很有意思。这次评测Coding Agent任务,DeepSeek用的是自己研发的DeepSeek Harness,而不是市面上常见的第三方基准。而且这套Harness也即将开源。
除了Harness,正式版V4-Flash还原生支持了Responses API格式,并且针对Codex做了专门的优化适配。这对开发者意味着什么?如果你之前是在OpenAI的生态里写代码,现在想切到DeepSeek,迁移成本又被压低了一截。官方文档里已经放了具体配置方法,基本上可以说是即插即用。这是要挖openAI祖坟去啊.....
第三方评测机构Artificial Analysis也给出了数据。DeepSeek V4 Flash正式版的Intelligence Index得分是50分,和Gemini 3.6 Flash打平。相比Preview版本的40分,直接涨了10分。更扎眼的是,它比DeepSeek自家的V4 Pro还高出6分,距离GPT-5.6 Luna和GLM-5.2的51分,只差1分。也就是说,在综合智能水平的维度上,V4-Flash正式版已经摸到了第一梯队的门槛。
但DeepSeek真正的杀手锏从来不只是分数,而是价格。正式版V4-Flash的API定价维持原样:输入1元每百万token,输出2元每百万token。同一天,OpenAI刚刚宣布GPT-5.6 Luna降价80%,摆明了是要在价格上狙击DeepSeek。但降价之后一对比,Luna的单价还是比V4-Flash高。而且DeepSeek的缓存命中价格有接近98%的折扣,算下来跑完同等Intelligence Index任务,V4-Flash的单任务成本比Luna低大约60%。能力接近,价格便宜一大截,Agent能力还明显补强,这一版又把性价比拉到了新高度。社区里有句话形容得很到位:DeepSeek的斩杀线来了,跑不过它的,都得死。
当然,V4-Flash也不是没有短板。它距离Kimi K3仍然还有一段距离,国内GLM-5.2也暂时领先1分。不过DeepSeek的牌还没打完,V4-Pro正式版据说即将发布,那才是真正的重头戏。
这次发布的时间点也颇值得玩味。OpenAI前脚刚降价,DeepSeek后脚就端出正式版V4-Flash,而且升级的是自己产品线里最便宜的模型。有网友调侃说,友商更新模型的时候,DeepSeek枪口上抬,行注目礼放行;OpenAI一降价,立刻重拳出击,精准打击对手的降价策略。这虽然是玩笑话,但确实反映了DeepSeek在定价策略上的攻击性。OpenAI这次降价,是第一次真正打进DeepSeek的价格区间,但梁文锋用一次技术升级证明,在绝对的成本优势面前,跟进降价未必能扭转局面。AI社区里已经开始有人把梁文锋叫"梁圣"了,虽然带着点调侃,但也确实是对其产品实力的认可。
不过也不是完全没有隐忧。有用户在硅基流动平台上看到提示,说V4 Pro的缓存命中价格可能在8月3日上调到1元每百万token。这个消息目前只在第三方平台出现,DeepSeek官方API价格暂时没有变动。如果是第三方渠道自己的行为,那开发者直接走官方API就好;但如果官方后续也有调整,那性价比优势可能会受到一些影响。这件事目前还没有明确说法,值得持续关注。
说到底,很多人信任DeepSeek,有一个很朴素的原因:它每次发评测结果、发技术细节,都极尽所能把所有参数写明白。这种透明度和可复现性,在眼下这个大模型厂商越来越喜欢"藏参数"的环境里,反而成了一种稀缺品质。就像一位开发者说的,真实数据是不怕被复现检验的。DeepSeek Harness开源之后,这种透明度只会更高。
从V2的惊艳亮相,到V3的性价比风暴,再到如今V4-Flash正式版在Agent能力上的质变,DeepSeek的每一步都在改写行业的成本曲线。OpenAI用降价试图守住城池,DeepSeek用技术升级正面迎击。这场交锋或许才刚刚开始,而对于广大开发者来说,一个Agent能力更强、调用成本更低、生态更开放的时代,正在以比预期更快的速度到来。