DeepSeek R2 为何迟迟不发?全网期待背后的多重博弈
DeepSeek-R1 发布后,继任者 R2 多次被传即将发布又多次被辟谣。据报道,CEO 梁文锋对模型表现的高要求是延期主因。
自 2025 年 1 月 DeepSeek-R1 震动全球 AI 圈后,继任者 R2 成为全网最受期待的模型之一,但其发布时间多次被媒体预测又多次落空:2025 年 5 月、8 月的“发布窗口”传闻均被接近 DeepSeek 的人士否认。
据 The Information 报道,CEO 梁文锋始终对 R2 的表现不满意是发布推迟的重要原因;也有分析指向算力供给约束与训练芯片选型的不确定性。
为什么“不够惊艳就不发”
R1 给 DeepSeek 留下的既是资产也是枷锁:全世界都在等一个“再震撼一次”的 R2,平庸的升级反而会损伤 R1 建立的叙事。这解释了为何宁可用 V3.1、V3.2 的小步迭代维持存在感,也不贸然打出 R2 这张牌——对靠单点爆发成名的实验室,品牌预期管理本身就是技术决策。
算力变量:芯片选型的两难
另一重约束是硬件:出口管制下的高端芯片供给不确定,国产芯片训练生态尚在磨合——在哪条路线上训 R2,决定了成本、周期与可复制性。R1 的神话建立在“受限算力下的极致工程”之上(参见本站 V3、R1 报道),R2 若想复刻,工程难度只高不低。
空缺期的赛道变化
R2 缺席的一年半里,推理赛道没有等人:o3 把工具入思维链、Gemini 3 登顶基准、Qwen、Kimi 在开源榜轮流坐庄(参见本站报道)。“下一个 R1 时刻”的窗口在收窄:当对手们都学会了低成本推理,震撼的门槛比 2025 年 1 月高得多。
本站解读
本站分析认为,R2 的难产折射出推理模型赛道的竞争烈度:在密集发版的背景下,“不够惊艳就不发”成为头部实验室的共同选择。R2 何时亮相、能否复刻 R1 时刻,仍是 2026 年最大悬念之一——而无论结果如何,“发布即事件”的预期本身,已经是 R1 留给这家公司最特殊的遗产。