曙光8000,重写中国算力交付方式
7月10日,光合组织2026智能计算应用大会在郑州举行,中科曙光正式宣布国内首个全国产十万卡AI超集群“曙光8000(登峰)”落成并接入国家超算互联网,成为国产算力从技术验证走向系统化落地的标志性事件。
十万卡级部署重定义AI基础设施能力门槛
过去行业衡量算力规模多以千卡、万卡为单位,而曙光8000的落地正式将AI基础设施的门槛抬升至十万卡量级。与万卡级系统相比,十万卡部署考验的早已不是计算卡数量与理论峰值的简单堆叠,而是系统架构、网络互连、访存效率、能效控制与生态应用能力的综合工程水平。中国工程院院士李国杰指出,算力基础设施是智能基础设施的根基,在可预见的未来,智能发展始终离不开算力支撑。当前人工智能正从大模型向智能体、具身智能快速演进,AI for Science也在推动基础研究加速突破,这些变革催生的算力需求不再是单一精度的计算,而是需要同时支持高精度科学计算与低精度AI训练的超智融合能力。曙光8000的落地,也让大规模算力中心的评价重心从规模比拼转向更综合的系统能力与实际产业价值。
全栈自研技术体系破解十万卡集群运行难题
曙光8000(登峰)具备“芯片、计算、存储、网络、散热、应用、服务”全链路全自研能力,从底层支撑到上层应用全面实现国产化。其中,自研ParaStor分布式存储系统在2026年IO500榜单中斩获生产型全节点与10节点性能全球第一,是中国厂商首次在生产类榜单获得双料冠军——该榜单基于落地一年的业务实践评测,对数据一致性、可靠性要求极高,直接反映商用存储系统的真实能力。针对十万卡集群的并发需求与长上下文推理场景,该系统实现全层级缓存池化,支持全局KV Cache统一管理,覆盖GPU HBM、节点本地SSD、分布式存储全链路,可保障多应用并发下的资源隔离,满足不同业务的服务质量要求。
在系统管控层面,集群可用性设计目标达99.99%,设备安装精度达到毫米级,全集群部署数字孪生管控系统;调度系统支持秒级万作业调度,批处理、裸金属、容器可弹性融合调度。中科曙光北京公司副总裁李柳介绍,整机柜交付模式可大幅缩短现场交付时间,全封闭液冷架构提升系统稳定性,模块化设计则显著提升维护效率。行业共识正在形成:国产芯片单卡性能与国际顶尖水平存在差距,但曙光8000的落地用实践证明,系统能力可以弥补单卡短板,通过高效协同、可靠稳定的集群设计,能够达到同等应用效果。
超智融合架构落地覆盖二十余行业核心场景
曙光8000采用“超智融合”技术路线,摒弃传统算力分区方式,实现全类型计算的原生一体化融合,支持从FP64到INT8的全精度覆盖,可同时支撑科学计算、大模型训练、AI推理、工业仿真等多类科研与产业场景。目前该系统已完成300余项超智融合应用优化,覆盖大模型、机器人、汽车、创新药、新材料、量子计算、天文气象等二十余个领域。其中超过70个应用实现了万卡规模扩展,20余个应用可跑满整机,40%的科学应用已结合AI方法,落地成果包括蛋白质折叠模拟、万亿原子级水分子动力学模拟、百万亿网格湍流模拟等重大科研任务,验证了国产十万卡集群承载核心业务的能力。
产业链协同创新打通算力交付“最后一公里”
曙光8000的落地不仅是单产品的突破,更是产业链协同能力的集中体现。该系统研制过程中,中科曙光调动了公司最核心的研发资源,同时协同光合组织上下游合作伙伴,将操作系统、第三方库以及应用端纳入同一套技术标准和适配流程,降低不同厂商产品之间的兼容成本,研制过程中便与国内头部应用团队持续开展软硬件协同优化。2026年以来,光合组织的协同节奏明显提速:2月启动国产万卡算力赋能大模型发展联合攻关行动,3月成立AIDC高速网络工作组,7月成立AIDC基础设施专委会,用组织化的方式解决产业链协同问题。本次大会上,光合组织正式推出“开放计算Token谱系计划”,旨在解决Token生产、流转、应用三个环节彼此割裂、算力中心各自为政、接口标准不统一等痛点,让Token能够在不同应用之间低成本流转,真正释放算力生产力。
曙光8000已依托国家超算互联网接入全国一体化算网,将面向科研高校、企业及个人用户全面开放算力服务。国海证券计算机行业首席分析师刘熹表示,曙光8000证明中国超大规模集群建设能力已达世界先进水平,将缩小中美算力供给差距,推动国产算力在重点行业实现规模化应用。大会期间,曙光还与北京科学智能研究院达成战略合作,启动第二套全国产十万卡超智融合算力系统研制与建设,未来十万卡级全精度算力中心有望从示范性工程走向规模化复制,成为支撑“人工智能+”应用全面落地的新一代基础设施标配。