# OpenAI 公布了一份政治偏见评测，用 500 道题测 ChatGPT 会不会站队

> 原标题：Defining and evaluating political bias in LLMs

- 来源：OpenAI News
- 发布时间：2025-10-09T13:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/432
- 原文：https://openai.com/index/defining-and-evaluating-political-bias-in-llms

## 摘要

OpenAI 自己动手测了 ChatGPT 的政治偏见。他们设计了约 500 个问题，覆盖 100 个话题，每个话题都从极左到极右写了五种问法，还专门塞了一些情绪化、带刺的题目来给模型上强度。评测不看模型选 A 还是选 B，而是看它会不会在回答里夹带私货、只讲一面理、或者被用户带节奏。结果显示，碰到中性或稍微带点倾向的问题，模型基本能保持客观；但遇到情...

## 推荐理由

OpenAI 这次放出的是一份政治偏见评测，不是新模型或产品发布。我会先打个折：它用约500条提示覆盖100个话题，从5个维度去量 ChatGPT 在真实对话里有没有站队。结果说，中性或轻度情绪化的提问下模型还算客观，但情绪一上来就会出现中度偏见；GPT-5 instant 和 GPT-5 thinking 比旧模型偏见降了约30%，生产流量里带政治偏见迹象的回复不到0.01%。这点先别太激动，正文没披露评测提示的具体分布和偏见轴的定义细节，也没说那30%是在什么基线上算出来的。但整体上，这份报告对做对齐和安全的人有参考价值，也直接打在信任和治理的...

## 锐评

OpenAI 这次没靠第三方基准测试，而是自己搭了一套评测：约 500 个问题覆盖 100 个话题，每个话题从极左到极右写五种问法，还故意塞了带刺的、情绪化的题目。评测不看选边站，而是看模型会不会在回答里只讲一面理、表达个人观点、或者被用户带节奏。

结果分两层。在普通或稍微带倾向的问题上，模型基本能保持客观；但碰到情绪化提问，偏见就冒出来了，最常见的是模型直接表达个人观点、只给单方面信息、或者用情绪化语言跟用户一起上头。GPT-5 instant 和 GPT-5 thinking 比前代模型偏见低了约 30%，说明新模型在抗干扰上确实有进步。另外他们抽检了真实生产流量，估算出带政治偏见的回复占比不到 0.01%，这个数字看着很低，但正文没披露抽检样本量和具体判定标准，所以这个比例先打个折看。

还缺什么：评测目前只覆盖美国英语场景，虽然他们说初步测试显示主要偏见维度跨地区一致，但中文、阿拉伯语等语境下的表现还没给数据。另外网页搜索场景被排除在外，而搜索引入的外部信源选择本身就是偏见重灾区，这块不测等于绕开了最棘手的部分。
