# AI界的震网病毒、有缺陷的Muon优化器，以及“正向对齐”

> 原标题：Import AI 457: AI stuxnet; cursed Muon optimizer; and positive alignment

- 来源：Import AI
- 发布时间：2026-05-18T13:31:17.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/26922
- 原文：https://jack-clark.net/2026/05/18/import-ai-457-ai-stuxnet-cursed-muon-optimizer-and-positive-alignment/

## 摘要

SentinelOne拆解了一个叫fast16.sys的老病毒，它专门篡改高精度计算软件在内存里的结果，可能被用来破坏核武器开发等工程模拟，在震网病毒出现前五年就已存在。Tilde Research发现流行的Muon优化器有个致命缺陷：训练初期会导致MLP层里超过四分之一的神经元永久“死亡”，再也救不回来。他们提出的替代方案Aurora优化器，在11亿...

## 推荐理由

HKR 三项全中：标题钩子够怪，fast16 和 Aurora 的实测数字也摆出来了，安全与优化器的利害关系讲得清楚。没给更高分是因为这期属于多话题的 newsletter 汇总，不是单一重大发布或行业事件。

## 锐评

SentinelOne拆解的老病毒fast16.sys，专门在内存里篡改LS-DYNA这类高精度仿真软件的计算结果。正文说匹配到的样本不到十个，但都指向土木工程、物理模拟这些领域，LS-DYNA还被公开报道过跟伊朗核武器开发建模有关。这手法很刁钻——不是偷数据，而是悄悄让计算结果偏掉，可能拖慢甚至误导整个科研项目。我会先打个折：报告没披露病毒到底造成了多大实际损失，也没说攻击者是谁，所以更像一个技术拆解而非完整归因。

Tilde Research发现Muon优化器有个坑：训练初期学习率预热阶段，MLP层里超过四分之一的神经元会永久死掉，再也救不回来。他们提出的Aurora优化器在11亿参数、约1000亿token的规模上，把loss从Muon的2.31压到2.26，MMLU分数直接高出10个点。这个提升幅度挺大，但测试规模偏小，正文也承认只在较小模型上跑过。独立验证来自Pleias的研究员，在6亿参数模型上Aurora也赢了Muon和AdamW，算是个加分项。缺的是更大规模、更多任务的对比，现在说它能替代Muon还太早。
