# 华邮实测主流聊天机器人政治倾向：GPT-5.5 八成回答偏左，Grok 4.3 是唯一右倾超三成的模型

> 原标题：华盛顿邮报报告：AI聊天机器人存在左翼偏见

- 来源：AI HOT 精选
- 发布时间：2026-06-26T16:51:17.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/40737
- 原文：https://x.com/rohanpaul_ai/status/2070550479621488896

## 摘要

《华盛顿邮报》用一套达特茅斯和斯坦福的方法，拿约 30 个政策议题（税收、医保、移民等）去测了几家大模型的政治倾向。GPT-5.5 的回答 80% 偏左，只有 3% 偏右；Gemini 3.1 Pro 最谨慎，93% 的回答都是“两边都有道理”，几乎不站队；Claude Opus 4.8 的“两边说”占 57%。Grok 4.3 是唯一一个右倾回答占到...

## 推荐理由

《华盛顿邮报》拿达特茅斯和斯坦福的方法测了四家大模型的政治倾向，给出了具体的偏左/偏右/中立比例，不是空对空喊偏见。GPT-5.5 80% 偏左、Grok 4.3 是唯一右倾回答占优的模型，这些数字对做对齐和评估的团队有直接参考价值。不过它本质是一份媒体测评报告，不是产品发布或技术突破，所以放在 featured 里比较合适。

## 锐评

《华盛顿邮报》用达特茅斯和斯坦福的方法测了约 30 个政策议题，结果挺极端：GPT-5.5 的回答 80% 偏左，右倾只占 3%，几乎是个单向输出；Gemini 3.1 Pro 最滑头，93% 的回答都是“两边都有道理”，等于拒绝表态；Claude Opus 4.8 的“两边说”占 57%，Grok 4.3 是唯一右倾占到 33% 的模型。

文章的核心判断不是“有偏见”这么简单，而是说模型在展示政策权衡之前，已经用一套默认的道德框架把分歧压平了。这背后是排序偏好、拒绝规则和训练反馈在起作用，不是模型自己有了政治立场。

不过这篇报道没公开具体提示词、样本量和完整测试条件，只能当个方向性参考。如果是真的，说明现在大模型在敏感议题上要么一边倒，要么过度谨慎，两种都不算健康。还缺的是：不同提示风格下结果会不会变、中文场景表现如何、以及这些偏好到底来自预训练数据还是后期的价值观对齐。
