爆料称 DeepSeek 下一波大模型将至:3 万亿参数,性能剑指 GPT-6 Astra
本周DeepSeek正式发布V4.1 Flash大模型,其底层架构改动幅度之大,实际性能表现已完全达到V5级别,但DeepSeek选择保持低调,并未同步调整大版本号。与此同时,官方已确认Pro系列后续新品为V4.1 Pro,具体升级细节尚未对外公布。结合V4到V4.1的升级幅度来看,V4.1 Pro的性能上限预期较高,但鉴于此前V4 Pro-0813正式版的市场表现不及预期,行业对其实际表现普遍持理性观望态度,期待值不宜过度拉高。

DeepSeek本周低调发布V4.1 Flash 架构升级幅度对标V5
爆料称9月将推DeepSeek Code 2.0 3万亿参数剑指顶尖前沿大模型
据最新爆料,DeepSeek后续还将推出全新旗舰级大模型产品DeepSeek Code 2.0,发布时间窗口锁定在9月。该模型的核心性能目标为击败当前全球最强大的两款前沿级大模型Mythos 5.1与GPT-6 Astra。功能定位上,DeepSeek Code 2.0将延续开源开放的策略,核心设计重点为“电脑控制(Computer Use)”,即通过AI自动替代用户操作电脑完成各类复杂工作,而GPT-6 Astra此前引发行业关注的诸多惊艳功能,正是依托这一能力实现。
3万亿参数量具备落地逻辑 对标国内头部大模型参数规模
爆料信息显示,DeepSeek Code 2.0的参数量将超过3万亿,这也是其冲击顶尖性能的核心硬件基础。从当前国内大模型的参数规模格局来看,参数量最高的产品为K3大模型的2.8万亿,其次是千问Qwen3.8 Max的2.4万亿,DeepSeek V4 Pro的参数量为1.6万亿。结合本周发布的V4.1 Flash通过更换新架构实现参数量翻倍的升级逻辑,Code 2.0从1.6万亿跃升至3万亿的参数规模具备较强的可信度——若想与Mythos 5.1、GPT-6 Astra同台竞技,这一级别的参数量是突破性能上限的必要条件。
当前国内主流大模型参数量规模如下:
- K3大模型:2.8万亿
- 千问Qwen3.8 Max:2.4万亿
- DeepSeek V4 Pro:1.6万亿
过往Code系列表现平平 爆料可信度待市场验证
尽管爆料信息具备一定的逻辑支撑,但其最终可信度仍需进一步验证。梳理DeepSeek过往的产品线,2023-2024年期间曾推出过三款名称带“Code”的大模型,但市场表现均较为平淡。本次若将Code系列升级为偏向代码、逻辑能力的旗舰级产品,与主打通用Agent任务的V4.1 Pro、V4.1 Flash形成差异化产品布局,倒也是符合行业竞争逻辑的合理方向,但最终实际表现仍需等待市场检验。