AI 安全研究员成立 Sequent:对齐这条路还没走稳
Import AI 461: “Alignment is not on track”; FrontierCode; and synthetic research interns
英国 AI 安全研究所和 Timaeus 的研究员联手搞了个非营利组织 Sequent,直接说当前的对齐方法是“被动打补丁”,在训练超级智能之前拿不出有原则的保证。他们打算先融 1 到 1.5 亿美元,同时押注可扩展监督、学习理论、博弈论等多个方向,目标是找到让对齐效果在不可控场景下依然靠谱的方法。另一边,Cognition 发布了编程基准 Front...
推荐理由:一群有安全研究背景的人跳出来说“对齐没上正轨”,还给出了融资目标和多方向押注的路线,这件事本身就值得从业者注意。我会先打个折——目前只是个组织成立的消息,没有技术验证或初步结果,但问题意识和人员背景让它有足够分量进入 featured。