四位AI科学家指出,AI已从被动训练迈向递归自我改进,人类需在拥抱其潜力的同时,通过可验证反馈与安全护栏引导其进化方向。
递归自我改进的悖论正在从科幻概念演变为现实工程,Anthropic的新模型与隐性安全干预揭示了权力重构中的信任裂痕。