# OpenAI 披露并阻断一起协同模型蒸馏攻击

> 原标题：Disrupting a coordinated model-distillation campaign

- 来源：OpenAI News
- 发布时间：2026-09-30T10:30:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/nn3jkl6f1piez81nf10174p10
- 原文：https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign

## 摘要

OpenAI 称近期发现并阻断了一起协同蒸馏攻击，最早活动出现在 7 月第一周，攻击者试图提取模型的受保护推理内容。7 月 24 日和 25 日出现高流量峰值，涉及 4,000 多名用户的 16,000 次请求，相关提示模式活动涉及超过 15,000 名用户，OpenAI 于 7 月 28 日前完全阻断。

## 推荐理由

OpenAI 披露了一次针对模型受保护推理的协同蒸馏攻击，并给出时间线与处置方式，可了解此类攻击的运作与防御思路。

## 锐评

OpenAI 把蒸馏攻击的锅扣到 Moonshot 头上，但正文自己承认"不清楚是否来自单一行为者"。16,000 次请求、4,000 个账号、7 月 28 日封完，数字给得挺细，归属却只有一句"与 Moonshot AI 相关人士"。这种指控要么给证据，要么别说名字——否则和发个通稿点名没区别。

另一面，攻击手法本身不新鲜：把加密推理从一段对话搬到另一段，让模型自己解密转录。真正暴露的是推理内容可被复制重放，OpenAI 现在才堵上这条路。对做 agent 的人来说，这比归属争议更值得看。
