​DeepSeek 传闻将推 3 万亿参数 Code 2.0,剑指 GPT-6 Astra

在人工智能领域激烈迭代的当下,DeepSeek近日再次成为行业焦点。除了本周低调发布架构改动幅度巨大、堪称换代的V4.1Flash之外,业界传出消息称,其后续即将推出备受瞩目的全新大模型——DeepSeek Code2.0。

​DeepSeek 传闻将推 3 万亿参数 Code 2.0,剑指 GPT-6 Astra

DeepSeek本周发布架构跃级V4.1Flash,产品矩阵扩容提速

本周DeepSeek正式推出V4.1Flash,虽然官方并未调整大版本号,但其底层架构的升级幅度实际上已经达到了V5的级别。与此同时,官方也已确定后续将推出V4.1Pro系列,不过具体的升级细节尚未完全公布。鉴于此前V4Pro-0813正式版的表现一度未达预期,市场对该系列的实际表现正保持理性的期待值。随着V4.1Flash的发布以及后续Code2.0的传闻流出,DeepSeek正通过多路线并行的产品布局,向全球顶尖的AI能力线发起持续冲击。

Code 2.0被曝9月亮相,3万亿参数剑指当前最强前沿大模型

据爆料信息显示,DeepSeek Code2.0的发布时间窗口为今年9月,最核心的升级在于参数量跃升至3万亿以上,性能指标有望正面击败当前最强的两年前沿级大模型Mythos5.1和GPT-6 Astra。从国内现有大模型的参数量格局来看,目前参数量领先的产品包括:

  • K3:2.8万亿参数
  • 千问Qwen3.8Max:2.4万亿参数
  • DeepSeek V4Pro:1.6万亿参数
    考虑到V4.1Flash通过新结构实现了参数量的翻倍,Code2.0从1.6万亿跃升至3万亿具备坚实的逻辑支撑。

主打电脑控制能力,开源路线瞄准Agent场景落地

在核心功能定位上,DeepSeek Code2.0预计将保持开源开放的传统,设计重心将全面转向“电脑控制”,即通过AI替代用户自动操作电脑完成各类复杂工作。业界分析指出,GPT-6 Astra目前诸多让人惊叹的使用效果正来自这一能力,DeepSeek押注该方向也符合当前AI Agent落地的主流趋势。值得一提的是,DeepSeek在2023-2024年曾推出过三款名字带Code的大模型,不过彼时表现平平,此次将Code系列升级为旗舰级产品,也标志着其正式向代码与逻辑处理的高端赛道发起冲击。后续V4.1Pro及Flash系列将主要面向通用Agent任务,与Code2.0形成差异化定位。

参数量跃升逻辑获业内认可,实际表现仍待市场检验

针对3万亿参数的设定,业内普遍认为其具备合理性:要跟Mythos5.1、GPT-6 Astra同级别的大模型竞争,就需要这个级别的参数量支撑,否则性能上限很难实现突破,V4.1Flash新结构实现参数量翻倍的表现,也为Code2.0的参数跃升提供了可行性参考。不过也有业内人士提示,此前V4Pro-0813正式版曾出现不及预期的情况,市场不应对Code2.0的期待值拉得过高,其最终表现仍需接受市场的实际检验。