首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >DeepSeek-V4炸裂登场!1M(百万 Token)上下文,把价格打下来,666

DeepSeek-V4炸裂登场!1M(百万 Token)上下文,把价格打下来,666

作者头像
OpenNiuma
发布2026-07-20 13:13:07
发布2026-07-20 13:13:07
740
举报

没有发布会的喧嚣,也没有预热海报的狂轰滥炸,DeepSeek-V4 悄悄更新了接口文档和状态栏,两个冷冰冰的字——“可用”,直接宣示了新一代旗舰模型的落地与开源。这场迟来的登场,带来了百万 Token 上下文的标配普惠、剑指顶级闭源模型的编程实力,以及把“高端算力”拉下神坛的极致性价比。属于码农与创作者的无上限“长文本自由”,终于来了。


一、跳票终结者

从二月传到四月,从“下周见”传到“再等等”,不少人一度以为这个项目要变成行为艺术。但当那个熟悉的接口文档悄然更新,同时上架 Hugging Face 开源的刹那,一切的等待好像又都值得了。

这次上线的 V4 并没有只扔出一个庞然大物,而是非常务实地划分了两个定位分明的版本:

  • DeepSeek-V4-Pro:1.6 万亿总参数,被外界认为是硬刚顶级闭源模型的“大杀器”,交付质量对标 Claude Opus 4.5 级别性能。
  • DeepSeek-V4-Flash:2840 亿总参数且仅激活 130 亿的轻量猛兽,主打一个“闭着眼用不心疼”的极速与高性价比。

二、长文本新王

2.1 百万级“浓缩果汁”

以往的模型,遇到动辄几十万字的项目源码或长篇小说,还得笨拙地分段、截断、搞 RAG,推理到后面甚至忘了前文设定的核心冲突。而 DeepSeek-V4 双版本全系标配了 1M Token(100 万) 上下文。什么概念?差不多就是把《三体》三部曲全部扔进聊天框,它都能轻松梳理出极致的脉络。这相当于把一本大部头丢进去,AI 还能精准回答其中的细节,再也不用担心“断片”。

2.2 根骨里的省流技术

能支撑百万上下文且不把显卡烧爆,源于它骨子里更换了全新的注意力引擎——压缩稀疏注意力(CSA)与重压缩注意力(HCA)的结合设计。在百万 Token 的超长序列推理场景下,V4-Pro 所需的单 Token 推理算力仅为前代 DeepSeek-V3.2 的 27% ,KV 缓存占用更是断崖式降到了只有原先的 10% 。这种改动对开发者意味着,一台普通开发机的同等算力,如今能承载的上下文长度翻了若干倍。

2.3 三档思考模式

V4 系列提供了三种推理强度选择:

推理模式

适用场景

特点

Non-think

日常闲聊、简单代码补全

快速直觉响应,省 Token

Think High

复杂业务逻辑、数学推导

开启逻辑分析,深度推理

Think Max

百万级大项目重构、高难竞赛题

全力推理,探索模型极限,需至少 384K 上下文窗口


三、编程核武器

对于程序员来说,这一次 V4 主打的就是“硬核编程”。

在横向对比中,DeepSeek-V4-Pro-Max 的成绩让不少闭源豪门头上冒冷汗。编程方面,LiveCodeBench 得分 93.5% ,Codeforces 评分 3206,两项均位列对比模型的第一,超过了 Gemini-3.1-Pro(91.7% / 3052)和 GPT-5.4(Codeforces 3168)。

在一线实战里,DeepSeek-V4 特意针对 Claude Code、OpenClaw、OpenCode 等主流编程智能体(Agent)工具做了性能适配调优。内部员工使用 V4 做辅助编程,评测反馈使用体验优于 Sonnet 4.5,交付质量已经逼近 Opus 4.6 的非思考模式。这意味着那些从前只有顶级闭源模型才能啃下来的硬骨头,现在用开源方案也未必会扛不住。


四、价格降维打击

大模型长文本最怕什么?一个字:贵。但是 V4 这次的定价,属于“老板没在店里随便卖”的水平。

模型版本

输入价格 (缓存命中)

输入价格 (未命中)

输出价格

DeepSeek-V4-Flash

0.2 元/百万 Token

1 元/百万 Token

2 元/百万 Token

DeepSeek-V4-Pro

1 元/百万 Token

12 元/百万 Token

24 元/百万 Token

某国际顶级闭源对标

/

/

动辄 V4-Pro 的 7 到 9 倍

这套价格体系,使得高精尖的 Agent 任务和日常编码辅助,都能找到恰到好处的成本平衡点。

五、两分钟上手

V4 即日起就可以在官网(chat.deepseek.com)或官方 App 直接体验,API 服务也已完成同步更新,可通过以下途径调用:

  • API 直连:base_url 保持不变,依然为 api.deepseek.com,只需要把模型名称改为 deepseek-v4-prodeepseek-v4-flash 就能用上新版本。
  • 接口兼容:全面兼容 OpenAI ChatCompletions 协议与 Anthropic 接口标准,零迁移成本。
  • 思考模式:要启动深度推理能力,只需设定 reasoning_effort 参数值为 high 或 max。
  • 开源部署:技术上偏爱离线端侧体验的用户,可以前往官方的 Hugging Face 仓库进行模型权重的一键下载,项目支持 FP4 与 FP8 混合精度,对民用级硬件也具有不错的亲和力。
  • 温馨提示:原有的 deepseek-chatdeepseek-reasoner 接口将于三个月后实现彻底停用,建议尽快完成平滑迁移。

当超大杯的万亿参数不再只是 PPT 里的奢侈品,当百万级 Token 上下文开始以近乎“白菜价”流入普通开发者的日常工作流,限制创造力的将只剩下想象力。DeepSeek-V4 的登场,最大的意义不在于谁的跑分又高了几分,而在于它正在把曾经昂贵稀缺的“深度智能”,逐渐变成挥洒自如的工程空气。

#DeepSeekV4发布 #百万Token上下文 #开源大模型 #编程辅助 #AI编程新纪元 #极致性价比

本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2026-04-24,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 OpenNiuma 微信公众号,前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 一、跳票终结者
  • 二、长文本新王
    • 2.1 百万级“浓缩果汁”
    • 2.2 根骨里的省流技术
    • 2.3 三档思考模式
  • 三、编程核武器
  • 四、价格降维打击
  • 五、两分钟上手
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档