跳到正文
Hacker News 首页

Jamie Simon 等 14 位作者发了一篇 41 页的论文,认为深度学习的科学理论正在成形

There Will Be a Scientific Theory of Deep Learning

这篇论文不是空谈路线图,而是把现有理论工作归成五条线索,论证一个可检验的定量理论已经冒头了。五条线索分别是:用理想化设定给真实训练过程提供直觉;在可计算的极限里看清学习现象;用简单数学规律抓住宏观可观测指标;把超参数的作用从训练过程里拆出来,让剩下的系统更干净;以及跨模型、跨设定都成立的通用行为。作者把这些统称为“学习力学”,强调它关心训练动态、粗粒度...

推荐理由:我会先打个折:这是一篇综述/立场论文,不是新实验或产品发布,所以放在 featured 而不是更高。但标题够大胆,而且 14 位作者给了 5 条具体研究线和一条硬判据——可证伪的定量预测,这比大多数“AI 要变科学了”的空话实在。正文没披露具体预测数值或验证结果,所以别当成熟理论看,但它把散落的工作串起来了,对做训练和 infra 的人有参考价值。

读原文 ↗导出 Markdown