北大校友翁荔官宣离职后加盟Mira Murati新公司Thinking Machines Lab,其AI安全理念与“照顾好自己”的人生态度引发行业共鸣。
OpenAI通过仅5%的有益人格特质数据训练,大幅提升模型对齐表现,并发现对齐的本质是改变模型底层人格而非具体规则,实现跨域泛化。