2026 年 4 月 24 日,深度求索(DeepSeek)正式发布DeepSeek‑V4 预览版并同步开源,以100 万 Token 超长上下文、顶尖推理与 Agent 能力、双版本梯度定价三大核心突破,宣告开源大模型正式迈入百万上下文普惠时代,性能全面对标全球顶级闭源模型。
一、核心定位:重新定义开源大模型上限
DeepSeek‑V4 以普惠、高效、强推理、长上下文为核心,面向开发者、企业与个人用户提供可商用、可部署、低成本的新一代基座大模型,官方服务全线标配 1M 上下文,彻底打破长文本处理的算力与成本壁垒。
二、双版本矩阵:旗舰性能 + 经济高效全覆盖
DeepSeek‑V4 提供Pro 旗舰版与Flash 轻量版,满足从科研、复杂 Agent 到低成本 API 调用的全场景需求。
型号 | 总参数 | 激活参数 | 预训练数据 | 上下文长度 | 定位 | 模式 |
|---|---|---|---|---|---|---|
DeepSeek‑V4‑Pro | 1.6T | 49B | 33T | 1M | 顶级性能,对标闭源天花板 | 专家模式 |
DeepSeek‑V4‑Flash | 284B | 13B | 32T | 1M | 快捷经济,兼顾推理与速度 | 快速模式 |
三、硬核能力:三大维度领跑开源领域
2. Agent 能力:开源领域最佳水平
3. 世界知识:大幅领先开源,紧追顶级闭源
在知识类测评中,DeepSeek‑V4‑Pro大幅领先开源模型,仅略逊于 Gemini‑3.1‑Pro,中文理解与知识准确性优势显著,长文本问答、文档总结、专业咨询更可靠。
4. 长上下文:1M 上下文成标配,效率革命性提升
四、API 服务:兼容主流接口,定价极具竞争力
deepseek‑v4‑pro
2)轻量版:deepseek‑v4‑flashdeepseek‑v4‑flash2. 价格(每百万 Token)
模型 | 输入(缓存命中) | 输入(缓存未命中) | 输出 | 上下文 |
|---|---|---|---|---|
V4‑Pro | 1 元 | 12 元 | 24 元 | 1M |
V4‑Flash | 0.2 元 | 1 元 | 2 元 | 1M |
3. 旧接口迁移提醒
deepseek‑chat与deepseek‑reasoner将于2026‑07‑24停止服务,当前已分别指向 V4‑Flash 非思考 / 思考模式,请尽快迁移。
五、开源与部署:权重全开源,本地 / 私有化自由部署
六、谁该用 DeepSeek‑V4?场景全覆盖
七、即刻体验:三大入口同步开放
deepseek‑v4‑pro/flash本文分享自 DevOps和k8s全栈技术 微信公众号,前往查看
如有侵权,请联系 cloudcommunity@tencent.com 删除。
本文参与 腾讯云自媒体同步曝光计划 ,欢迎热爱写作的你一起参与!