# AI 健康工具越来越多，但没人说得清它们到底靠不靠谱

> 原标题：There are more AI health tools than ever—but how well do they work?

- 来源：MIT Technology Review · AI
- 发布时间：2026-03-30T16:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/3497
- 原文：https://www.technologyreview.com/2026/03/30/1134795/there-are-more-ai-health-tools-than-ever-but-how-well-do-they-work/

## 摘要

微软上线了 Copilot Health，亚马逊把 Health AI 从 One Medical 会员专属开放给所有人，加上年初 OpenAI 的 ChatGPT Health 和能调取健康档案的 Claude，面向普通人的 AI 健康问答成了大厂标配。微软说 Copilot 每天收到 5000 万个健康问题，需求确实摆在那里，尤其对看病不方便的人群...

## 推荐理由

这篇文章不是产品发布，而是趋势报道加安全质疑。我会先打个折：微软和 Amazon 都在推消费级健康聊天机器人，但正文没披露任何独立安全评测，六位受访学者也点出这个问题。Mount Sinai 的研究是全文最硬的信息——ChatGPT Health 会误判轻重，说明光靠公司自测基准不够。这点先别太激动，因为研究样本和具体方法正文没展开，但方向值得盯。整体看，信息量够、风险点明确，适合放进 featured。

## 锐评

微软、亚马逊、OpenAI、Anthropic 全挤进面向普通人的 AI 健康问答赛道，微软说 Copilot 每天收到 5000 万个健康问题，需求确实大。但文章采访的六位学者没一个觉得现在能放心用，核心问题就一个：没有独立第三方来验货。

西奈山那项研究直接点出风险——ChatGPT Health 对轻症会过度建议跑医院，真遇到急症反而可能漏掉。牛津的 Andrew Bean 说得挺实在：模型可能确实到了能推出来的水平，但证据链得跟上。现在厂商自己跑跑基准测试就上线，评测方法和数据又不公开给外部审查，盲区在哪谁也不知道。

文章没披露这些产品在真实场景里出错的频率和严重程度，也没说各家有没有做过头对头比较。医疗容错率极低，光靠厂商自说自话远远不够。
