# OpenAI 高管内部承认用盗版书训练模型违法，但担心的是被 Hacker News 曝光

> 原标题：OpenAI Feared "Optics" of what might appear on Hacker News

- 来源：Hacker News 首页
- 发布时间：2026-09-27T06:19:33.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/59214
- 原文：https://authorsguild.org/news/ag-v-openai-top-execs-knew-mass-book-piracy-was-illegal/

## 摘要

作家协会诉 OpenAI 案新公开的法庭文件显示，包括 CTO Mira Murati 和联合创始人 Ilya Sutskever 在内的高管私下把 LibGen 这类盗版书数据集称为“我们知道不合法”的数据，但照用不误。研究负责人 Bob McGrew 还专门提过“在 Hacker News 上会是什么观感”的公关风险。文件同时表明，OpenAI 内...

## 推荐理由

作家协会诉 OpenAI 案新解封的文件里，高管私下承认用的盗版书数据集不合法，还担心 Hacker News 上的舆论反应，但数据照样用。这种“明知有问题却先干了再说”的内部记录，既有冲突又有具体人名和引语，正好打在版权争议的痛点上。

## 锐评

这批解封的法庭文件把 OpenAI 内部的真实态度摊开了。CTO Mira Murati、联合创始人 Ilya Sutskever 等高管私下把 LibGen 这类盗版书数据集称为“我们知道不合法”的数据，但结论是照用不误。研究负责人 Bob McGrew 还专门提过“在 Hacker News 上会是什么观感”，说明他们很清楚这事一旦曝光会引发多大反弹。

文件里另一个关键点是，内部承认大规模吞书会损害作者生计，但同时认为跳过这一步就做不出有竞争力的模型。这等于自己把“创新”和“侵权”绑在了一起。不过要注意，这些文件来自作家协会一方的法律陈述，OpenAI 的完整回应还没公开，目前看到的是一面之词。

还缺什么：OpenAI 具体用了多少本书、哪些书，以及内部是否有过替代方案的认真讨论，正文都没披露。另外，法庭最终怎么认定“合理使用”边界，才是决定这件事性质的关键，现在下结论还早。
