Token 调用量涨 6 倍!华为:运力成 AI 算力最大瓶颈,不该执着单芯片制程

Token消耗半年暴涨6倍,AI算力焦虑全面爆发

大模型从技术验证迈入商用,AI Agent成为互联网业务核心增长引擎。然而,行业智能化升级深陷多重困境。华为中国政企互联网行业总经理黄健援引机构数据指出:过去半年内,Token消耗量增长了6倍,模型调用次数增加了约50至100倍。这一爆发式增长远超社会与行业的适配速度,催生了普遍的AI转型焦虑。黄健预计,2027年至2030年间,Token经济将全面影响所有作业行为及工作框架,短短三年内消化如此巨大的转变,给行业带来巨大压力与挑战。

运力成新瓶颈:华为直言“不该执着单芯片制程”

在算力、存力和运力三者中,运力是目前最突出的瓶颈。黄健表示,与其执着于单芯片制程,不如通过网算存协同一体化将“高速公路修得更宽”。他介绍,华为已将NPO带宽提升八倍以上,Token产生效率提升五倍。大模型训练和推理对通信时延与集群互联要求急剧上升,华为依托星河AI数据中心网络和昇腾超节点,从硬件、软件、调度、生态四层协同,大幅降低分布式通信损耗,并通过弹性调度适配业务波峰波谷和多并发场景。

网算存一体化协同:“高速公路”如何拓宽?

华为提出“网算存”一体化协同解决方案。具体路径包括:

  • 硬件层:提升NPO带宽,优化集群互联能力。
  • 软件层:灵渠、高可靠等产品支撑模型训练与推理。
  • 调度层:弹性调度适配业务波峰波谷,多并发场景灵活应对。
  • 生态层:与主流开源社区协同,参与社区贡献、治理、路标规划,将优质特性上传社区,降低开发者迁移门槛。

分层服务体系:为互联网企业定制专属算力方案

针对互联网行业高并发、高稳定的特殊需求,华为搭建三层专属服务体系:

  • 头部互联网大厂:配备百余人研发与行业复合型工程师,提供贴身管家式服务,覆盖全生命周期交付运维。
  • 中小互联网企业:联合生态伙伴提供标准化服务,涵盖前期算力架构规划、网络优化部署,以及日常7×24小时远程和现场运维。
  • 持续迭代:持续提供开源框架适配、版本迭代配套等服务,确保企业技术演进不脱节。

开源生态与开发者工具:降低大模型落地门槛

华为投入几千人在主流开源软件适配,进行联合创新,支撑好模型进而支撑好业务使用。同时与业界主流开源社区协同,参与开源社区的贡献、治理、路标规划,并将优质特性上传社区,为开发者提供高效、高品质的算力底座与易用开发工具,大幅降低大模型训推、迁移落地门槛。通过这些努力,华为有信心支撑互联网或大模型厂商的发展。