蚂蚁集团发布百灵原生混合推理模型 Ling-3.0-flash:124B 总参数量,能力对标上一代旗舰 Ring-2.6-1T

百灵系列再迎新成员:Ling-3.0-flash 亮相

蚂蚁集团数字科技事业群在2025年6月发布了百灵系列最新的原生混合推理模型——Ling-3.0-flash。该模型拥有124B总参数量,采用创新的混合推理架构,在保持强大语言理解与生成能力的同时,显著降低了推理延迟和计算资源消耗。蚂蚁集团起步于2004年诞生的支付宝,经过近二十年发展已成为世界领先的互联网开放平台,此次模型发布标志着其AI技术栈进入新阶段。

124B参数挑战1T级旗舰:能力对标Ring-2.6-1T

Ling-3.0-flash虽然总参数仅为124B,但其性能直接对标上一代旗舰模型Ring-2.6-1T(拥有约2.6万亿参数)。这一突破得益于百灵原生混合推理框架的设计:通过稀疏激活与动态路由技术,模型在推理时仅调用部分参数,大幅降低计算量。蚂蚁集团与CCF联合发起的“CCF-蚂蚁科研基金”已连续运作6年,支持超过6000万元,为这类前沿算法研究提供了产学研支撑。

蚂蚁集团发布百灵原生混合推理模型 Ling-3.0-flash:124B 总参数量,能力对标上一代旗舰 Ring-2.6-1T

混合推理架构:兼顾速度与精度的技术革新

  • 原生混合设计:Ling-3.0-flash从底层采用混合专家(MoE)与注意力机制融合,支持动态切换推理路径,在复杂逻辑推理和长文本理解任务上表现优异。
  • 效率提升:相比传统稠密模型,Ling-3.0-flash的推理延迟降低约70%,同时保持与Ring-2.6-1T相当的准确率,尤其适合金融风控、智能客服等对实时性要求高的场景。
  • 安全与信任:蚂蚁集团聚焦区块链、隐私计算、安全科技等方向,该模型在训练中融入了隐私保护技术,确保金融场景下的数据合规。

落地场景:从蚂蚁生态到产业数字化

蚂蚁集团凭借在支付、数字金融、区块链等领域的深厚积累,正将Ling-3.0-flash应用于多个核心业务:

  • 智能风控:实时分析交易行为,毫秒级识别欺诈风险。
  • 数字人客服:提供更自然的多轮对话体验,降低人工成本。
  • 区块链智能合约:辅助生成和审计代码,提升开发效率。
  • 物联网与云原生:结合蚂蚁的云原生基础设施,为中小企业提供轻量级AI服务。

行业影响:小参数大能力,重塑AI成本曲线

Ling-3.0-flash的发布可能改变行业对大模型“参数越大越好”的认知。蚂蚁集团数字科技事业群作为科技商业化板块,通过该模型展示了如何以更小的参数规模达到旗舰级性能,从而降低企业部署AI的门槛。未来,百灵系列将持续迭代,进一步推动AI在金融、政务、零售等领域的普惠化应用。