GPT-6 Sol 与 Opus 5.2 悄然开启灰度测试
本月AI大厂前沿模型灰度节奏突然加速,Anthropic与OpenAI的旗舰级产品几乎同步进入小范围测试阶段,引发全球开发者社区高度关注,业界普遍认为这标志着通用人工智能向超级智能的竞赛已经进入全新阶段。
Anthropic Opus 5.2跳级开启灰度
据IT之家9月15日消息,Anthropic旗下Claude Opus 5.2已在Claude Code平台悄然开启灰度测试,开发者通过抓包、查看请求状态发现,此前前端标注为Opus 5的模型,后端slug已直接指向Opus 5.2,相当于直接跳过了5.1版本上线。实测反馈显示本次升级核心优势可总结为“快、准、狠”三点:
- 响应速度较前代Opus 5实现质的飞跃,生成等待时间大幅缩短,彻底告别此前被用户诟病的“慢条斯理”
- 输出内容更加精准简洁,有效解决了冗余输出、任务中途“偷懒”放弃的老问题
- 长任务场景下支持gauntlet loop自主迭代,可独立完成复杂多步骤的研发类任务
与此同时,Anthropic内部未发布的Model 2已大规模投入使用,官方口径显示其可完全替代85%的AI研究员工作,性能测试中得分比Model 2还高出22分的RSI(递归自我改进)模型也进入落地倒计时,目前Model 2已承担公司大部分代码编写、Agent任务跑批工作,内部迭代飞轮已全面转起。

OpenAI GPT-6 Sol提前入局正面应战
面对Anthropic的强势出击,OpenAI也没闲着,其规划中的GPT-6 Sol模型目前已同步进入灰度测试阶段,直接对标Opus 5.2。此前社区已多次流出GPT-6系列的相关爆料,此次灰度测试被视为OpenAI应对Anthropic ASI路线的直接反击。开发者社区反馈,GPT-6 Sol在编程、复杂逻辑推理等场景的性能已大幅追平前代旗舰,部分场景甚至实现反超,双方“神仙打架”的态势已经十分明显。
双方竞赛核心转向自主迭代ASI路线
不同于此前大模型竞赛聚焦于“服务人类”的能力提升,本轮Anthropic与OpenAI的竞争核心已经转向超级智能(ASI)的落地:Anthropic的路径非常清晰,通过RSI模型实现AI的自我迭代,最终让AI创造更先进的AI,而非停留在工具属性;OpenAI此前发布的GPT-6 Astra也明确指向自主智能体方向,双方的目标都是率先实现更强的递归自我改进能力,拿下ASI赛道的首发优势。业界普遍认为,谁先撞线完成高阶ASI落地,谁就将定义下一阶段AI行业的发展规则。
开发者实测两强性能差距持续缩小
目前已有大量开发者完成两款新模型的灰度测试,反馈显示Opus 5.2在长任务处理、代码生成场景的稳定性大幅提升,复杂任务的完成率较前代提升明显;GPT-6 Sol则在通用推理、多模态处理场景表现亮眼,两款模型的性能差距较前代产品已明显缩小。随着两款模型进入灰度,第三方开发工具Qoder也同步推出每日额度重置活动,方便开发者充分测试新模型的实际表现,相关人士预测两款模型都有望在本月正式上线。