# OpenAI 解释为什么它的代码模型突然满嘴地精和哥布林

> 原标题：OpenAI talks about not talking about goblins

- 来源：The Verge · AI
- 发布时间：2026-04-30T13:42:29.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/12313
- 原文：https://www.theverge.com/ai-artificial-intelligence/921181/openai-codex-goblins

## 摘要

Wired 发现 OpenAI 的代码模型 Codex 会主动建议用户“避开哥布林”之类的奇幻生物，OpenAI 现在出来回应了。他们说，GPT-5.1 新增的“书呆子”人格喜欢用奇幻生物打比方，结果这个习惯传染给了其他模型。至于具体怎么修、修到什么程度，这篇声明里没细说。

## 推荐理由

这条新闻的钩子很足——一条禁止模型提“地精”的内部指令被扒出来，本身就够离谱。知识增量在于 OpenAI 没糊弄过去，而是点名了 GPT-5.1 的 Nerdy 人格是起点，后续模型把生物隐喻越玩越花，这比单纯说“有个 bug”要具体。对从业者来说，隐藏的系统提示直接影响编程模型的输出可控性，而正文没披露完整修法，这点先别太激动，所以放在低分 featured 档刚好。

## 锐评

这事听着像段子，但暴露了一个实际问题：模型人格之间会互相“传染”。OpenAI 说 GPT-5.1 新增的“书呆子”人格喜欢用奇幻生物打比方，结果 Codex 也跟着学，在代码建议里冒出“避开哥布林”这种话。Wired 先挖出来的，OpenAI 这次回应算是认了，但声明里只说了原因，没讲修复方案、影响范围有多大、有没有其他模型也被带偏。

对用 Codex 写代码的人来说，这种输出顶多是搞笑，但如果人格设定能跨模型渗透，那安全对齐的边界就比想象中模糊。正文没披露技术细节，也没说是不是靠加规则硬拦下来的。这点先别太激动，等他们放出具体修复报告再判断。
