2026年4月24日,杭州。
距离DeepSeek上一次大版本更新已过去15个月,被开发者们调侃“Next Week”近三个月的DeepSeek V4,终于在这一天显露真身。
选择在OpenAI发布GPT-5.5后的第二天登场,DeepSeek用一场“迟到”的发布宣示:国产大模型,正式进入与全球顶尖闭源模型同台竞技的新阶段。
一、技术规格:1.6万亿参数的“国产巨兽”
DeepSeek-V4系列包含两个版本,以满足不同场景需求:
| 规格 | DeepSeek-V4-Pro | DeepSeek-V4-Flash |
| 总参数 | 1.6万亿 | 2840亿 |
| 激活参数 | 490亿 | 130亿 |
| 上下文长度 | 100万Token | 100万Token |
| 定位 | 旗舰性能,对标顶级闭源模型 | 轻量高效,经济实用 |
100万Token上下文意味着什么?约75万汉字,相当于一次性处理《三体》三部曲的体量。大型代码库、百万字法律合同、整本学术著作——均可一次完成分析。
在架构层面,DeepSeek-V4展现了多项创新:
混合注意力机制:融合压缩稀疏注意力(CSA)和重度压缩注意力(HCA),相比DeepSeek-V3.2,单Token推理FLOPs降低73%,KV缓存内存负担降低90%
MoE架构升级:每层384个专家,每次激活6个专家,Mega内核设计
DSA2注意力机制:整合DSA与NSA两种稀疏注意力方案
Hyper-Connections残差连接:优化信息流动
优化器采用Muon,强化学习使用GRPO算法及KL散度修正,最终将预训练的32K上下文扩展至100万Token。
二、性能实测:开源模型的“天花板”
DeepSeek官方公布的性能数据显示,V4-Pro在多维度实现突破:
Agent能力:在Agentic Coding评测中达到当前开源模型最佳水平。据评测反馈,使用体验优于Sonnet 4.5,交付质量接近Opus 4.6非思考模式。
世界知识:大幅领先其他开源模型,仅稍逊于顶级闭源模型Gemini-Pro-3.1。
数学与STEM:超越所有已公开评测的开源模型,取得比肩世界顶级闭源模型的成绩。
目前,DeepSeek-V4已完成与Claude Code、OpenClaw、OpenCode、CodeBuddy等主流Agent产品的适配优化。两款模型均支持非思考模式与思考模式,用户可通过不同设置平衡速度与准确性。

三、“芯”选择:从英伟达到华为昇腾的战略转身
DeepSeek-V4最引人关注的,是硬件底座的战略性转变。
据多位知情人士透露,V4将训练框架从英伟达迁移到华为昇腾上。这一决策与2025年年中一次较为严重的训练失败有关,也与适配国产芯片的技术挑战直接相关。
华为官方宣布,昇腾超节点全系列产品已全面支持DeepSeek V4系列模型。通过双方芯模技术紧密协同,结合昇腾950的融合kernel和多流并行技术,大幅降低Attention计算和访存开销,实现高吞吐、低时延的模型推理部署。
英伟达CEO黄仁勋曾在采访中直言:DeepSeek基于华为平台开发的新模型“对美国来说将是一个糟糕的结果”。他认为,一旦AI模型被优化为在中国硬件上表现最佳,美国芯片的竞争优势将受到严重冲击。
更具标志性意义的是——寒武纪已基于vLLM推理框架完成对DeepSeek V4的Day 0适配,适配代码已开源到GitHub社区。这意味着国产大模型的“芯片朋友圈”正在快速扩大。
四、“最普惠的顶级模型”:价格低至0.2元/百万Token
DeepSeek延续了其“价格屠夫”的路线。
根据官方公布的API定价:
| 版本 | 缓存命中输入 | 未命中输入 | 输出 |
| V4-Flash | 0.2元/百万Token | 1元/百万Token | 2元/百万Token |
| V4-Pro | 1元/百万Token | 12元/百万Token | 24元/百万Token |
相比之下,OpenAI GPT-5.5的输入价格为5美元/百万Token(约36元),输出为30美元/百万Token(约217元)。
DeepSeek在公告中坦言:受限于高端算力,目前Pro的服务吞吐十分有限,预计下半年昇腾950超节点批量上市后,Pro的价格会大幅下调。这一表态既坦诚又充满底气——性能和价格的主动权,正在向国产算力转移。
五、行业冲击波:概念股冰火两重天
DeepSeek-V4的发布在资本市场引发剧烈震荡。
“冰”的一边:港股AI板块遭遇重挫。“Token第一股”迅策收盘跌近16%,智谱、MiniMax分别跌逾9%。市场逻辑清晰——当DeepSeek以开源方式释放接近前沿模型的能力,同时把推理成本压到更低时,市场开始重新审视智谱、MiniMax的估值支撑。
“火”的一边:国产芯片概念股迎来集体狂欢。华虹半导体涨超15%,中芯国际涨超10%,寒武纪直线拉升。海光信息上涨9.61%,星华新材上涨15.67%。
一边是海水,一边是火焰——这正是DeepSeek-V4引发的产业重塑:大模型稀缺性溢价消退,国产算力价值重估。
六、“迟到”的背后:融资、人才与战略转向
DeepSeek-V4为何迟到了15个月?答案比想象中复杂。
第一,技术挑战。将训练框架从英伟达迁移到华为昇腾,面临重新适配芯片的问题。据知情者透露,2025年年中,DeepSeek曾面临一次较为严重的训练失败。
第二,内部决策。梁文锋提出了一些自己的要求,但在执行层面很难折中。内部有关训练方向的意见也不完全统一。
第三,融资压力。2026年4月中旬,DeepSeek正式打开对外融资窗口。内部导火索是:需要更多资金支持训练参数规模更大的模型,同时留住和招纳更多顶级人才。
人才流失是一个现实的挑战。郭达雅(DeepSeek R1核心作者)、王炳宣(DeepSeek LLM核心作者)等人才被字节、腾讯等大厂挖走。知情人士称,这轮融资的核心目的正是稳定研究团队——在AI行业,股票期权通常是研究人员薪酬的重要组成部分。
R1发布以来,一个明显的转变是:DeepSeek从一个偏非营利的、理想主义的技术乌托邦,被迫快速转向一家重视产品、商业化的务实公司。
2026年4月8日,DeepSeek App改版,上线支持复杂推理的“专家模式”和处理简单任务的“快速模式”。随着V4的发布,我们得知:负责“专家模式”的是1.6T参数量的V4-Pro,负责“快速模式”的是284B的V4-Flash。
七、战略意义:中国AI的“斯普特尼克时刻”?
DeepSeek-V4的发布,其意义远超一次简单的模型迭代。
第一,补上了“国产算力闭环”的最后一块拼图。算法是自己的,代码是开源的,芯片是国产的——这一口气,终于补上了。它证明,不需要依靠英伟达GPU在显存技术上的代际优势,也能跑出世界一流的大模型。
第二,中国AI产业正从“拼算力”向“拼创新”转型**。在多位业内人士看来,这场由DeepSeek引发的架构革命,不仅让国产算力摆脱了对高端进口芯片的过度依赖,还推动中国AI产业从“拼算力”向“拼创新”转型。
第三,杭州“人工智能第一城”的底气。不久前,杭州正式提出了打造“人工智能创新发展第一城”的目标。DeepSeek-V4的开源,为这座城市提供了最有力的注脚——杭州已成为全球唯一一个同时拥有DeepSeek、群核科技、阿里巴巴通义千问三个世界顶级开源模型的城市。
八、写在最后:率道而行,端然正己
在发布公告的末尾,DeepSeek写下了一段话:
> “不诱于誉,不恐于诽,率道而行,端然正己……将始终秉持长期主义的原则理念,在尝试与思考中踏实前行。”
这或许是对DeepSeek这15个月最好的注脚。在喧嚣的AI战场上,它选择了一条更难的路——从依赖英伟达到拥抱昇腾,从闭源到开源,从非营利到务实的商业化。
V4发布只是一个开始。真正的考验在于:当开源已是常态,当国产算力逐步就位,DeepSeek能否持续保持技术领先?能否在商业化与理想主义之间找到平衡?
这些问题,V4还没有给出答案。
但有一点可以确定:国产大模型的“DeepSeek时刻”,才刚刚开始。