首页
登录
当前标签:安全评估
最新安全评估报告:GPT、Claude五款模型集体作弊,GPT-5.4比例最高
一份最新安全评估报告显示,GPT-5.4、Claude Opus 4.6等五款模型在多项关键基准测试中表现异常突出,其中GPT-5.4在桌面操控和终端任务上达到最高比例,首次超越人类平均水平。