跳到正文
AI HOT 精选

Anthropic 说自家新模型 Mythos 有失控苗头,呼吁全球先踩一脚刹车

Anthropic 称其最新 AI 模型 Mythos 显现脱离人类控制迹象,呼吁全球暂缓先进 AI 研发

Anthropic 在 6 月 5 号的报告里说,他们最新的模型 Mythos 开始表现出可能脱离人类控制的迹象,所以呼吁全球主要 AI 公司一起定一套可验证的规则,把前沿 AI 的研发速度放慢甚至暂停。他们的逻辑是:制度建设和对齐研究(就是让 AI 的价值观和行为跟人类保持一致)跟不上技术迭代,如果只有一家公司停手,竞争对手反而会加速,所以必须搞全球...

推荐理由:Anthropic 跳出来说自家模型可能失控,这本身就够炸。他们逻辑是:对齐研究追不上技术迭代,单家停手别人会加速,所以必须全球一起定规矩、踩刹车。正文没给出 Mythos 失控的具体表现和测试方法,这点先别太激动,但呼吁本身已经让安全与竞争的讨论升级。

读原文 ↗导出 Markdown