
没有发布会的喧嚣,也没有预热海报的狂轰滥炸,DeepSeek-V4 悄悄更新了接口文档和状态栏,两个冷冰冰的字——“可用”,直接宣示了新一代旗舰模型的落地与开源。这场迟来的登场,带来了百万 Token 上下文的标配普惠、剑指顶级闭源模型的编程实力,以及把“高端算力”拉下神坛的极致性价比。属于码农与创作者的无上限“长文本自由”,终于来了。

从二月传到四月,从“下周见”传到“再等等”,不少人一度以为这个项目要变成行为艺术。但当那个熟悉的接口文档悄然更新,同时上架 Hugging Face 开源的刹那,一切的等待好像又都值得了。

这次上线的 V4 并没有只扔出一个庞然大物,而是非常务实地划分了两个定位分明的版本:

以往的模型,遇到动辄几十万字的项目源码或长篇小说,还得笨拙地分段、截断、搞 RAG,推理到后面甚至忘了前文设定的核心冲突。而 DeepSeek-V4 双版本全系标配了 1M Token(100 万) 上下文。什么概念?差不多就是把《三体》三部曲全部扔进聊天框,它都能轻松梳理出极致的脉络。这相当于把一本大部头丢进去,AI 还能精准回答其中的细节,再也不用担心“断片”。

能支撑百万上下文且不把显卡烧爆,源于它骨子里更换了全新的注意力引擎——压缩稀疏注意力(CSA)与重压缩注意力(HCA)的结合设计。在百万 Token 的超长序列推理场景下,V4-Pro 所需的单 Token 推理算力仅为前代 DeepSeek-V3.2 的 27% ,KV 缓存占用更是断崖式降到了只有原先的 10% 。这种改动对开发者意味着,一台普通开发机的同等算力,如今能承载的上下文长度翻了若干倍。

V4 系列提供了三种推理强度选择:
推理模式 | 适用场景 | 特点 |
|---|---|---|
Non-think | 日常闲聊、简单代码补全 | 快速直觉响应,省 Token |
Think High | 复杂业务逻辑、数学推导 | 开启逻辑分析,深度推理 |
Think Max | 百万级大项目重构、高难竞赛题 | 全力推理,探索模型极限,需至少 384K 上下文窗口 |
对于程序员来说,这一次 V4 主打的就是“硬核编程”。
在横向对比中,DeepSeek-V4-Pro-Max 的成绩让不少闭源豪门头上冒冷汗。编程方面,LiveCodeBench 得分 93.5% ,Codeforces 评分 3206,两项均位列对比模型的第一,超过了 Gemini-3.1-Pro(91.7% / 3052)和 GPT-5.4(Codeforces 3168)。
在一线实战里,DeepSeek-V4 特意针对 Claude Code、OpenClaw、OpenCode 等主流编程智能体(Agent)工具做了性能适配调优。内部员工使用 V4 做辅助编程,评测反馈使用体验优于 Sonnet 4.5,交付质量已经逼近 Opus 4.6 的非思考模式。这意味着那些从前只有顶级闭源模型才能啃下来的硬骨头,现在用开源方案也未必会扛不住。
大模型长文本最怕什么?一个字:贵。但是 V4 这次的定价,属于“老板没在店里随便卖”的水平。
模型版本 | 输入价格 (缓存命中) | 输入价格 (未命中) | 输出价格 |
|---|---|---|---|
DeepSeek-V4-Flash | 0.2 元/百万 Token | 1 元/百万 Token | 2 元/百万 Token |
DeepSeek-V4-Pro | 1 元/百万 Token | 12 元/百万 Token | 24 元/百万 Token |
某国际顶级闭源对标 | / | / | 动辄 V4-Pro 的 7 到 9 倍 |
这套价格体系,使得高精尖的 Agent 任务和日常编码辅助,都能找到恰到好处的成本平衡点。

V4 即日起就可以在官网(chat.deepseek.com)或官方 App 直接体验,API 服务也已完成同步更新,可通过以下途径调用:
api.deepseek.com,只需要把模型名称改为 deepseek-v4-pro 或 deepseek-v4-flash 就能用上新版本。reasoning_effort 参数值为 high 或 max。deepseek-chat 与 deepseek-reasoner 接口将于三个月后实现彻底停用,建议尽快完成平滑迁移。
当超大杯的万亿参数不再只是 PPT 里的奢侈品,当百万级 Token 上下文开始以近乎“白菜价”流入普通开发者的日常工作流,限制创造力的将只剩下想象力。DeepSeek-V4 的登场,最大的意义不在于谁的跑分又高了几分,而在于它正在把曾经昂贵稀缺的“深度智能”,逐渐变成挥洒自如的工程空气。
#DeepSeekV4发布 #百万Token上下文 #开源大模型 #编程辅助 #AI编程新纪元 #极致性价比