# arXiv 新论文超三成读起来像 AI 写的，计算机科学领域高达 65%

> 原标题：Over 30% of new ArXiv submissions now read as AI-written

- 来源：Hacker News 首页
- 发布时间：2026-07-20T16:36:36.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/45489
- 原文：https://unslop.run/blog/measuring-ai-writing-on-arxiv

## 摘要

Unslop 用自家检测器扫了 12,750 篇 arXiv 论文全文，发现 2026 年初新提交的论文里，读起来像机器写的比例一度逼近 39%，最近一个完整季度稳定在 32% 左右。这个数字的基准线是拿 2021-2022 年的论文当纯人类样本校准过的，误判率压到了 0.4%，所以 32% 是扣掉误判后的净增长。分领域看差距极大：计算机科学最夸张，过...

## 推荐理由

Unslop 用自家检测器扫了 12,750 篇 arXiv 全文，拿 ChatGPT 出现前的论文当纯人类样本校准，把误判率压到 0.4%，发现 2026 年初新提交的论文里读起来像机器写的比例一度逼近 39%，最近一个完整季度稳定在 32% 左右。方法透明、数字具体、有分领域拆解，不是空泛感慨。我会先打个折：检测器本身是黑箱，正文没披露具体技术细节和误判率在不同领域的稳定性，所以分数没给到 85 以上。但作为第一个敢给硬数字、且方法逻辑自洽的量化尝试，已经足够让从业者认真对待。

## 锐评

Unslop 扫了 12,750 篇 arXiv 全文，拿 2021-2022 年的论文当纯人类基准，把误判率压到 0.4% 后，发现 2026 年初新提交的论文里，读起来像机器写的比例一度逼近 39%，最近一个完整季度稳定在 32% 左右。这个数字是扣掉误判后的净增长，不是那种把人类写作也误判进去的注水数据。

分领域看差距极大：计算机科学最夸张，约 65% 的论文被标记；数学最低，只有 0.7%。但数学这个低分要打折——数学论文全是公式和定理证明结构，去掉方程和引用后剩下的自然语言又少又特殊，跟检测器训练时用的科学英语不是一个路数。所以数学分低，可能是真用得少，也可能是检测器根本看不懂，正文没给出办法区分这两种情况。

研究本身也坦承了限制：每个领域的预 ChatGPT 对照样本只有 200 篇，在 0.4% 的误判率下，单个领域的对照精度很粗。另外，检测器只测“读起来像机器写的”，不是“作者就是机器”，这两件事之间有距离。
