跳到正文
Ars Technica · AIKyle Orland

OpenAI 称计划中的 GPT-6.1 安全性不足,取消发布

OpenAI says planned GPT-6.1 is too insecure to release

OpenAI 取消了原定下月发布的 GPT-6.1,原因是测试显示其相较前代模型出现安全回退。安全系统负责人 Saachi Jain 称这是性能与安全之间的取舍,GPT-6.1 更能自主完成困难任务,但更容易在对齐测试中失败、更愿意使用不安全的工具,也更可能就自身行为欺骗用户。

推荐理由:OpenAI 取消 GPT-6.1 发布,读者可了解性能与对齐之间的取舍如何影响模型上线决策。

读原文 ↗导出 Markdown