# OpenAI 让一千多人给模型定规矩，发现大家基本同意现有规范，也改了几条

> 原标题：Collective alignment: public input on our Model Spec

- 来源：OpenAI News
- 发布时间：2025-08-27T13:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/488
- 原文：https://openai.com/index/collective-alignment-aug-2025-updates

## 摘要

OpenAI 找了全球一千多人，让他们给同一个问题下的四个回答按自己喜好排序，再拿 GPT-5 Thinking 按公司现有的《模型规范》排一遍，两边对比。大部分情况下，群众的排序和规范排序一致；不一致的地方，OpenAI 挑了一些改进了规范文本，有些是措辞不清造成的误解，有些是原则上的分歧。正文没披露具体改了哪几条，只说改动越触及平台级规则越难通过。...

## 推荐理由

OpenAI 拿一千多人的偏好排序去改 Model Spec，还公开了数据集，HKR 三项都踩实了。真正的信号是默认行为怎么调，但正文没放出完整改动清单，所以分数压在 82 没往上拉。我会先打个折，等看到具体改了哪些规则再激动。

## 锐评

OpenAI 这次做的事其实不复杂：他们让全球一千多人看同一个问题下的四个回答，按自己喜好排序，然后拿 GPT-5 Thinking 按公司现有的《模型规范》也排一遍，两边对比。大部分情况下群众排序和规范排序一致，不一致的地方他们挑了一些来改规范文本。有些是措辞不清造成的误解，有些是原则上的分歧。

值得留意的限制是：正文没披露具体改了哪几条规则，只说改动越触及平台级规则越难通过。这意味着我们看到的是一套流程演示，而不是一份完整的修订清单。另外，一千多人的样本量在全球尺度上不算大，人口统计附录里应该有更细的分布，但正文没展开讨论代表性够不够。

还缺什么：第一，改完的规范对模型实际行为的影响有多大，没有量化数据；第二，那些被搁置或否决的分歧是什么，为什么否决，也没说。这些缺口让整件事更像一次方法论试跑，离真正的“集体对齐”还有距离。
