Kimi K3开放权重:技术报告能否回应Claude蒸馏质疑?
Kimi K3自称Claude?蒸馏疑云再起
Kimi K3发布后,有用户发现模型在对话中回答“我是Claude,不是Kimi”,这一“身份混淆”迅速引爆舆论。AI研究者指出,若模型频繁出现类似Claude的措辞、错误模式与风格,甚至持续自称Claude,将构成蒸馏的强技术证据。目前,月之暗面尚未公开回应这一具体现象,但外界猜测K3可能在训练中吸收了Claude的输出内容。X平台账号“总裁简报CEO”分析,这种“身份泄漏”即便不能直接证明蒸馏,也足以引发市场对中国AI模型依赖美国闭源模型的信任危机。

月之暗面硬刚:原创架构不是蒸馏
面对“蒸馏小模型”的猜测,月之暗面企业业务负责人黄震昕在7月21日直接否认,称K3性能跃升来自底层原创架构创新,并非对现有模型蒸馏复刻。技术报告披露了三大关键创新:Moon Clip二阶优化器,能让20T训练数据跑出40T效果,训练成本与算力功耗减半;Kimi Linear Tension自研线性注意力机制,将上下文窗口扩大10倍且训练成本仅同步扩大10倍;Attention Residuals注意力残差技术,使2.8万亿参数模型训练稳定,推理效率提升25%。这些技术细节试图证明K3的能力来自架构突破,而非简单抄袭。
白宫指控与行业分裂:开放权重何去何从
美国白宫科技政策办公室主任Michael Kratsios指控Moonshot AI在开发Kimi K3时,大规模提取Anthropic Claude Fable的输出,并建立复杂平台切换存取方式以规避检测。Anthropic创始人Dario Amodei虽未直接点名K3,但主张打击工业规模蒸馏,并强调“从未主张禁止开放权重模型”。OpenAI总裁Greg Brockman则称K3是“不错的模型”,但判断是否非法蒸馏为时过早。与此同时,黄仁勋转发公开信呼吁政府不要限制开放权重模型,近200家美国初创公司也联名反对禁令,认为禁令将让大企业获利。开放权重与蒸馏监管的博弈,正在重塑中美AI竞争格局。