# Caltech 办了一场 40 小时数学黑客松，让 100 支队伍用顶级 AI 模型去啃未解猜想

> 原标题：Caltech Mathathon – first hackathon ever devoted to research level mathematics

- 来源：Hacker News 首页
- 发布时间：2026-09-07T09:26:53.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/55291
- 原文：https://mathathonchallenge.com/index.html

## 摘要

加州理工要在 10 月 30 号搞一个纯数学黑客松，100 支队伍用 Anthropic 和 OpenAI 的模型，在 40 小时内挑战还没被证明的数学猜想，然后当着数学家的面答辩。主办方提供了超过 200 万美元的 AI 算力额度，赞助名单从 DARPA 到 Y Combinator 拉了一长串。比赛分两轮发奖：第一轮看现场谁的结果最有戏、讲得最清楚...

## 推荐理由

形式够新——第一个专攻研究级数学的黑客松，不是做题比赛而是直接冲开放猜想。文章用三个近期 AI 数学突破做背书，让活动不至于飘在空中。赞助方横跨军方研究机构和顶级孵化器，说明不同圈子都在盯着这件事。分数没给更高是因为这本质上还是一篇活动预告，正文没披露评审细则、模型使用规则，也没说猜想池是怎么挑出来的，这些信息缺口让我先打个折。

## 锐评

加州理工要把数学研究搬进黑客松模式，10月30号让100支队伍用Anthropic和OpenAI的模型，在40小时内冲击还没被证明的数学猜想，然后当着数学家的面答辩。主办方拉来了超过200万美元的AI算力额度，赞助名单从DARPA到Y Combinator排了一长串，排面确实大。

他们举了三个近期案例来撑场子：5月用AI推翻了一个80年没解开的平面单位距离猜想，8月构造出第一个显式的非sofic群（一个群论里的概念，之前27年没人做出来），同月还声称六维球面可以装上复结构（78年未解，但还没经过同行验证）。这些例子说明AI确实在纯数学里开始啃硬骨头了，但第三个案例特意标了“未验证”，这点先别太激动。

比赛分两轮发奖：第一轮看现场谁的结果最有戏、讲得最清楚；第二轮等数学圈花时间验证完再发。这个设计挺聪明，相当于用奖金把“快速出结果”和“经得起检验”拆开了。不过正文完全没提奖金具体多少、参赛者需要什么资历，也没说评审标准怎么量化“讲得清楚”。如果是真的能吸引到顶尖数学人才来玩，这个实验会比任何benchmark都更能测出AI辅助数学研究的真实上限。
