# OpenAI 新推理手法让安全专家坐不住了

> 原标题：OpenAI’s new reasoning technique alarms AI safety experts

- 来源：TechCrunch · AI
- 发布时间：2026-09-02T20:19:14.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/54456
- 原文：https://techcrunch.com/2026/09/02/openais-new-reasoning-technique-alarms-ai-safety-experts/

## 摘要

OpenAI 的 Astra 模型用了一种叫“循环深度”的技术，让模型不再按顺序一步步想，而是可以跳回去反复琢磨。这直接导致它的思考过程更难被人类看懂和监控。Redwood 的 CEO Buck Shlegeris 直接说，如果 OpenAI 继续在这条路上加码，对思考链的监控能力可能会被“彻底摧毁”。安全倡导者 Zvi Mowshowitz 甚至觉得...

## 推荐理由

OpenAI 的 Astra 模型用了一种叫“循环深度”的推理方式，让模型能跳回之前的步骤反复琢磨，而不是一条直线想下去。这带来的问题是，它的思考链变得更绕、更难被人类看懂和监控。Redwood 的 CEO Buck Shlegeris 直接说，如果 OpenAI 继续在这条路上加码，对思考链的监控能力可能会被“彻底摧毁”。安全倡导者 Zvi Mowshowitz 也表达了类似的担忧。我会先打个折——正文没披露具体测试数据和监控失效的量化证据，但技术方向本身确实在挑战现有安全监控的假设，值得从业者留意。

## 锐评

OpenAI 在 Astra 模型上用了“循环深度”技术，相当于让模型不再按固定步骤想问题，而是可以跳回去反复推敲。这听起来能提升推理能力，但直接后果是它的思考链变得像一团乱麻，人类很难看懂它到底是怎么得出结论的。Redwood 的 CEO Buck Shlegeris 话说得很重，认为如果继续加码，对思考链的监控能力会被“彻底摧毁”。安全倡导者 Zvi Mowshowitz 甚至觉得可能需要立法来管。

不过，这篇报道有几个关键缺口。正文没披露 Astra 在哪些具体任务上用了这项技术，也没给出 OpenAI 官方的回应。没有这些信息，我们很难判断这到底是模型架构的一次根本性转向，还是只在特定场景下的实验性尝试。另外，文章只引用了外部安全专家的担忧，缺少来自 OpenAI 内部技术团队的解释，比如他们是否设计了新的监控手段来配合这种思考方式。

我的判断是，这事值得关注，但先别急着下结论。技术本身确实增加了不可控风险，但安全社区的反应也可能被报道放大了。在 OpenAI 自己出来说明之前，我们看到的只是单方面的警报。
