# 哈佛研究：AI 在急诊室给出的诊断比两位人类医生更准

> 原标题：In Harvard study, AI offered more accurate emergency room diagnoses than two human doctors

- 来源：TechCrunch · AI
- 发布时间：2026-05-03T18:00:09.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/13208
- 原文：https://techcrunch.com/2026/05/03/in-harvard-study-ai-offered-more-accurate-diagnoses-than-emergency-room-doctors/

## 摘要

哈佛医学院和贝斯以色列女执事医疗中心的研究团队在《科学》杂志发了一篇论文，拿大语言模型和急诊室医生比诊断准确率。结果至少有一个模型的表现超过了人类医生。但报道没提具体是哪个模型、测了多少病例、准确率数字是多少，也没说医生资历和评判标准。所以结论方向有意思，细节先别太激动。

## 推荐理由

HKR 三项都踩中了：哈佛用真实急诊病例测 LLM，诊断准确率压过两名医生，听着就很抓人。但正文没给模型名、没给样本量、也没给具体准确率，信息缺口明显，所以重要性停在 77，没往上走。

## 锐评

这篇报道讲的是哈佛医学院和贝斯以色列女执事医疗中心在《科学》上发的一项研究，拿大语言模型和急诊室医生比诊断准确率，结论是至少有一个模型表现超过了人类医生。方向挺有意思，但报道本身信息缺口很大——没说是哪个模型、测了多少病例、准确率具体差多少，也没交代医生的资历和评判标准是什么。

这种“AI 赢了医生”的标题容易让人以为模型已经能独立看病了，但急诊诊断的准确率受很多因素影响：病例难度、医生经验、评判金标准怎么定，这些都没披露。而且研究是在真实急诊场景还是回顾性数据上做的，正文也没说清楚。

想认真评估这条结论，得去翻原论文看实验设计、样本量和统计显著性。如果样本小或者评判标准偏主观，那“更准”这个说法就得再打个折。
