OpenAI 披露并阻断一起协同模型蒸馏攻击
Disrupting a coordinated model-distillation campaign
OpenAI 称近期发现并阻断了一起协同蒸馏攻击,最早活动出现在 7 月第一周,攻击者试图提取模型的受保护推理内容。7 月 24 日和 25 日出现高流量峰值,涉及 4,000 多名用户的 16,000 次请求,相关提示模式活动涉及超过 15,000 名用户,OpenAI 于 7 月 28 日前完全阻断。
推荐理由:OpenAI 披露了一次针对模型受保护推理的协同蒸馏攻击,并给出时间线与处置方式,可了解此类攻击的运作与防御思路。