首页
登录
当前标签:对齐机制
A社承认Claude安全对齐存在缺陷,但“尚无解决方案”
A社(Anthropic)公开承认旗下大模型Claude的安全对齐机制存在尚未攻克的缺陷,目前暂无有效解决方案,相关消息引发AI行业对模型安全治理边界的广泛讨论。