学生盲测 6851 票:写大学论文,Gemini 赢了 Claude 和 ChatGPT
Students prefer Gemini over ChatGPT and Claude for AI essays in blind tests
StudyArena 让学生盲选 AI 写的论文,不看模型名字只看内容。Gemini 拿了 39.6% 的票,Claude 31.8%,ChatGPT 29.2%。学生明显偏爱更长的回答,胜出的回答平均比输家长 37%。一个反直觉的发现是,开高推理模式反而会降低写作得票率,低推理设置赢了 40.7%,高推理只赢了 29.5%,因为想太多会让文章变得啰嗦...
推荐理由:这篇是 StudyArena 自己发的产品博客,不是第三方基准测试,我会先打个折。但 6,851 次盲投的数据量不算小,结论也够反直觉:学生就是喜欢更长的回答,胜出回答平均比输家长 37%;开高推理模式反而让文章变啰嗦、得票更低。对做 AI 写作产品的人是个挺具体的信号——用户要的不是“想太多”的文本,而是读起来顺畅、篇幅够的内容。正文没披露学生来自哪些学校、论文题目是什么,这点先别太激动。