# OpenAI 说 ChatGPT 默认模型 GPT-5.5 Instant 的幻觉问题少了一大截

> 原标题：OpenAI claims ChatGPT’s new default model hallucinates way less

- 来源：The Verge · AI
- 发布时间：2026-05-05T17:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/14532
- 原文：https://www.theverge.com/ai-artificial-intelligence/924225/openai-chatgpt-default-model-gpt-5-5-instant

## 摘要

ChatGPT 把免费用户和 Plus 用户的默认模型换成了 GPT-5.5 Instant。OpenAI 内部测试显示，在容易出高风险幻觉的提示上，它比上一代 GPT-5.3 Instant 的瞎编次数少了 52.5%；在被标记为“难聊”的对话里，不准确的说法也降了 37.3%。不过正文没披露测试集到底有多大，也没说这些“高风险提示”具体怎么定义的，...

## 推荐理由

OpenAI 把 ChatGPT 默认模型换了，还主动报了两个幻觉下降的数字，热点、新知、关联度都够。不过正文没给评测集规模和复现方法，我会先打个折——数字好看，但暂时没法独立验证。默认模型换人本身就是当天该推的料，所以还是给了 p1。

## 锐评

ChatGPT 把免费和付费用户的默认模型悄悄换成了 GPT-5.5 Instant，主打一个“幻觉更少”。OpenAI 自己测下来，在容易出高风险幻觉的提示上，瞎编次数比上一代降了 52.5%；在被标记为“难聊”的对话里，不准确的说法也少了 37.3%。这两个数字看着漂亮，但正文没披露测试集规模，也没说“高风险提示”到底怎么划的线——是医学法律问题，还是泛指事实类提问，完全不清楚。

对普通用户来说，默认模型升级意味着不用手动切模型就能用到更新版本，体验上可能感觉回答更靠谱了一点。但别指望它就不编了，52.5% 是相对降幅，不是绝对清零。而且内部测试和真实用户乱问的场景差距通常不小，实际表现还得看上线后的反馈。

目前缺的关键信息：第三方基准测试结果、测试集的具体构成、以及这种幻觉降低有没有牺牲回答的有用性或速度。这些不补上，就只能当一次常规模型迭代来看。
