# ChatGPT Health 上线了，它比“谷歌医生”靠谱多少？

> 原标题：“Dr. Google” had its issues. Can ChatGPT Health do better?

- 来源：MIT Technology Review · AI
- 发布时间：2026-01-22T17:38:09.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/3888
- 原文：https://www.technologyreview.com/2026/01/22/1131692/dr-google-had-its-issues-can-chatgpt-health-do-better/

## 摘要

OpenAI 本月推出了 ChatGPT Health，不是新模型，更像一个加了健康指导和外挂工具（比如可选的病历、健身数据）的包装壳。OpenAI 说每周有 2.3 亿人用 ChatGPT 问健康问题。但真正的考验是评估：有研究让 GPT-4o 在看不到选项的情况下答医学执照题，专家打分只有大约一半的回答完全正确；另一项用更贴近真人提问方式的研究里，...

## 推荐理由

H、K、R 三条都站得住：标题的替代叙事比普通产品发布更有钩子，正文给了具体使用量和两项评估结果，医疗场景天然高风险。分数留在 79 不变，因为这是 OpenAI 在现有模型上加的一层产品包装，不是新模型发布，而且落地细节、监管和法律责任正文都没展开，我会先打个折。

## 锐评

OpenAI 这次推出的 ChatGPT Health，本质上是在现有模型外面套了一层健康场景的壳，接入了病历和健身 App 数据。它想解决的是“谷歌看病”信息混杂的老问题，让模型替用户筛选信源。但文章引用的评估数据并不乐观：一项让 GPT-4o 不看选项直接答医学执照题的研究里，专家打分只有大约一半的回答完全正确；另一项更贴近真人提问的测试中，准确率约 85%。这说明模型在开放场景下的可靠性依然有限。

文章没披露这 2.3 亿周活用户的具体提问类型，也没说 OpenAI 如何界定“健康问题”。更关键的是，产品上线前两天刚曝出青少年因 ChatGPT 用药建议过量死亡的案例，OpenAI 却强调这只是“辅助支持”，这种定位在真实使用中很难守住边界。哈佛医学院的 Succi 提到患者提问水平在提高，但没给出量化对比，更像个人观察。

还缺什么：产品实际接入病历后的错误率、对高危问题的拦截机制、以及长期临床验证数据，正文都没提。
