负结果的一生:一次实验说不之后要过五道关
AI 做研究的真正瓶颈不是想不出点子,而是实验失败后怎么处理这次失败。文章对比了两项评测:普林斯顿的影子评审实验里,AI 独立写出的论文被人类审稿人打了 2/6 和 1/6 的拒稿分;Prime Intellect 的算法优化长程测试中,Fable 5 系统在 8.7 天内关掉了与人类纪录 81.7% 的差距。差距不在灵感,在对待负结果的方式。Grok...
推荐理由:这篇文章用两个硬核评测的数字,把 AI 做研究的讨论从“能不能想出点子”拽到了“实验黄了怎么办”这个被忽略的环节,切口小但扎得深。扣分是因为正文只展开讲了前两道关(归因和传播),后面三道关没细说,信息密度打了折扣。