Kimi突发K2.8:性能逼近K3,百万上下文全员开放

7月16日,北京月之暗面科技有限公司正式发布新一代开源基础模型Kimi K3,其2.8万亿参数的规模创下全球开源模型参数纪录,同时综合智能水平已接近全球前沿闭源模型,被部分开发者评价为具有“Fable级体感”。该模型上线即开放100万Token上下文窗口,同步提供API服务及开发者文档,定位为面向长程智能体编程与自我演进工作流的“前沿智慧”基础模型,主要覆盖软件工程、知识工作、复杂推理等高难度场景。

2.8万亿参数开源模型落地 性能比肩国际顶尖闭源系统

在提前测试阶段,就有开发者反馈Kimi K3在复杂智能体(Agent)任务、连续编程、多工具调用场景中,自主规划与执行能力接近此前仅顶级闭源模型才能达到的水平。海外对冲基金经理的评测结果显示,Kimi K3性能超过Claude Opus 4.8,定价仅为后者的60%;国内内资行团队测评后也认为,其能力超过Opus 4.8,接近Claude Fable 5与GPT-5.6 Sol。虽然受限于Fable系列模型未公开完整参数与测试细节,无法进行严格的一对一对比,但公开评测已证明Kimi K3在部分知识工作、智能体能力测试中超过Claude Opus 4.8,标志着中国开源模型正式进入与美国顶级闭源模型竞争的新阶段。新华社报道指出,这是目前全球参数最大的开源模型,标志着我国人工智能模型发展迈出新的一步。金融时报援引知情人士消息称,Kimi K3虽然预计仍无法超越Anthropic此前因安全问题暂停发布的超前沿模型Fable,但已足以挑战市场长期以来“中国模型落后美国8至12个月”的普遍认知。

KDA+AttnRes技术突破 百万上下文解码效率提升6.3倍

Kimi K3引入了月之暗面自研的Kimi Delta Attention(KDA)混合线性注意力机制与Attention Residuals(AttnRes)结构,通过优化长序列信息处理与深层网络信息传递能力,大幅提升大规模模型的训练与推理表现。官方数据显示,KDA技术实现了百万级上下文下高达6.3倍的解码加速,AttnRes机制以不到2%的额外成本,提升了约25%的训练效率。同时模型采用Stable LatentMoE架构,将专家数量扩展至896个,每次推理仅激活16个,相较前代Kimi K2,整体扩展效率提升约2.5倍,可更高效地将算力资源转化为模型能力。此外,模型原生支持视觉理解能力,可处理文本、图像等多模态输入,进一步拓展了应用场景边界。

7月27日全量开放权重 同步开源三项关键训练基建

7月16日Kimi K3发布时,已同步上线Kimi、Kimi Work、Kimi Code平台及API服务,开发者可立即调用使用。而7月27日,月之暗面将全量公开Kimi K3的完整模型权重、技术报告,以及支撑模型训练的三大关键Infra技术:面向超大细粒度MoE的高性能通信库MoonEP、KDA机制的高性能算子FlashKDA、支持大规模Agent工作流的沙箱系统AgentEnv。作为遵循开源协议发布的开放权重模型,全球开发者可在遵守相应许可证的前提下,免费下载、自行部署并对模型进行修改,有望像DeepSeek一样快速形成繁荣的开发者生态。不过需要说明的是,受限于硬件门槛,完整部署2.8万亿参数的Kimi K3需要上百万元的算力设备,目前仅大型企业、科研机构具备完整本地部署能力,普通开发者可通过API或平台调用使用。针对开源模型可能存在的安全风险,国内已建立“敏捷监管与全栈布局”机制,通过合规备案、全栈评测、应用安全管理等方式,防范恶意微调、越狱、隐私泄露等问题。

开放生态冲击商业格局 中国开源模型进入全球竞争新阶段

当前全球AI领域的竞争已不止于模型性能,更延伸至成本与开放生态的角逐。美国头部AI公司持续投入数千亿美元建设基础设施,前沿模型商业化价格持续上涨,Anthropic计划今年9月起将Claude Opus 4.8的输入Token价格提升至每百万3美元,输出Token价格提升至每百万15美元,涨幅达50%。相比之下,Kimi K3定价仅为Opus 4.8的60%,且采用开放权重模式,对坚持封闭模型策略的OpenAI、Anthropic形成持续竞争压力。
从实际应用表现来看,Kimi K3已在多项测试中跻身第一梯队:

  • 评估终端工程任务能力的Terminal Bench 2.1中取得88.3分,仅次于GPT-5.6 Sol的88.8分,高于Claude Fable 5与Claude Opus 4.8的84.6分;
  • 衡量AI Agent完成一般知识工作能力的GDPval-AA v2中取得1668分,超过Claude Opus 4.8、GPT-5.5及GLM-5.2;
  • 同时是首个登顶Frontend Code Arena国际权威代码盲测榜的国产大模型,在Artificial Analysis智能指数中排名全球第三,是开源界的“领头羊”。
    官方展示的应用案例覆盖自主优化GPU核心、从零打造GPU编译器、设计执行AI模型的芯片、生成互动式产业研究报告、完成重力波分析与视频剪辑等多元场景,其中Kimi K3仅用约2小时就完成了原本需资深研究人员花费1至2周完成的计算天文物理研究,展现了长时程复杂任务的自主执行能力。这也是首次让免费可下载的开源模型能力摸到顶尖闭源系统下沿,过去仅交订阅费才能使用的超级AI大脑,现在有机会让更多人用上。