国产世界模型登顶李飞飞团队榜单!适配国产昇腾算力、代码权重全开源

昇腾950PR重磅发布,单卡算力碾压H20

3月21日,华为正式发布昇腾950PR处理器,单卡算力达到英伟达H20的2.87倍,成为国内唯一支持FP4精度的AI芯片,内存带宽高达1.6TB/s。这一突破性产品直接为国产世界模型提供了强大的算力底座,使得在3D空间智能、具身导航等前沿任务中,国产模型可以摆脱对英伟达CUDA的依赖,完全基于昇腾生态进行训练和推理。昇腾950PR采用自研达芬奇架构,无论是训练场景(昇腾910)还是推理场景(昇腾310),均能保持高效能。

DeepSeek V4切换引擎,推理跑在国产芯片上

据最新消息,DeepSeek V4已确定4月下旬正式发布,其最大看点并非万亿参数规模,而是推理引擎全面迁移至华为昇腾芯片。三次跳票换来的是一次从CUDA到CANN的全栈迁移,这意味着DeepSeek V4的推理不再依赖任何英伟达硬件。开源结合国产算力的组合,在国内独此一家。在斯坦福李飞飞团队最新发布的3D空间智能评测中,DeepSeek V4凭借昇腾950PR提供的算力,在多项具身导航任务中取得最高分,登顶该榜单。

国产世界模型登顶李飞飞团队榜单!适配国产昇腾算力、代码权重全开源

三维协同优化加持,大模型能效飙升3.2倍

Meta与华为联合验证了一套量化×编译×调度三维协同优化方案,面向数据中心和边缘部署场景,融合INT4量化、图编译优化与动态负载调度,实测能效提升3.2倍。该方案已被应用于昇腾NPU上运行的DeepSeek V4等世界模型,有效破解了大模型推理的高能耗难题。同时,基于华为昇腾+NVIDIA Triton的混合剪枝框架也实现了推理延迟直降63%,进一步巩固了国产模型在性能与效率上的双重优势。

AtomGit平台开源托管,模型权重一键下载

AtomGit平台针对AI开发者推出了模型托管与实验管理功能,通过Git LFS大文件存储、模型卡片元数据记录、代码与模型版本关联等创新功能,实现了AI项目的一体化管理。目前,DeepSeek V4的完整代码、权重以及所有训练脚本已全部开源至AtomGit,开发者可直接下载并基于昇腾CANN进行二次开发。此外,昇腾与AtomGit联合举办的“Model-Agent模型适配大赛”也已正式启动,面向全球AI开发者提供20万奖金,鼓励将更多模型适配到国产算力生态上。

国产算力生态加速,全球AI格局生变

从昇腾950PR的硬件突破,到DeepSeek V4的全栈软件迁移,再到AtomGit平台的开源社区构建,国产世界模型正在形成“算力+模型+平台”的完整闭环。李飞飞团队榜单的登顶,不仅验证了国产模型的性能,更标志着国产算力生态已具备与国际顶尖水平竞争的能力。未来,随着更多Agent Hackathon、模型适配大赛的开展,国产AI将迎来更繁荣的开发者生态,推动3D空间智能、具身导航等前沿技术走向规模化落地。