# Anthropic 烧了 3100 万 token 搜黎曼猜想，真正的信号在搜索架构

> 原标题：Anthropic 用 31M output token 搜索黎曼猜想，真正的信号在搜索架构

- 来源：Computing Life · Share · 鸭哥调研
- 发布时间：2026-08-13T00:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/50634
- 原文：https://yage.ai/share/anthropic-riemann-zeta-search-20260813.html

## 摘要

Anthropic 用未发布的 Claude 把黎曼 zeta 函数零点在临界线上的比例下界从 41.6% 推到了 67.2%，离证明黎曼猜想还差得远。真正值得看的是搜索过程：两次 Claude Code 会话烧掉 3100 万输出 token，第一轮 650 个想法全部失败，但留下了一份记录 106 条局部存活路线的台账，标明了每条路卡在哪、重新打开...

## 推荐理由

Anthropic用未公开模型做数学搜索，3100万token的工程细节和敌对评审机制是真正的信号，不是纯PR。扣分是因为纯数学离产品落地还远，而且正文没披露模型名称和token成本。

## 锐评

这条新闻最该看的是失败怎么变成资产，而不是数学数字涨了多少。Anthropic让Claude跑了两次大规模搜索，第一轮650个想法全部撞墙，但系统没把失败当垃圾扔掉，而是给每条死路记了“死亡报告”：卡在哪、哪段推导还成立、什么条件下可以重新打开。第二轮就拿着这份106条的台账去排查旧缺口，再开新方向，最后靠多个子代理接力把下界推到了67.2%。

这里有个关键细节要打折：2024到2026年已有学者在“窄盒条件”下推到了67.25%，Claude的真正贡献是扔掉了这个假设，把无条件证明拼了出来。所以25.6个百分点的跨越不能全算在AI头上。另外，论文里提到的有效形式没放进形式化验证，用于符号检查的脚本也没公开，第三方独立人类复核目前缺席。

把这事跟OpenAI之前的数学成果放一起看，趋势很清楚：AI生成和形式化证明的速度在飞涨，但人类看懂、吸收的速度没变。瓶颈正从“能不能找到”转向“找出来大家敢不敢认”。
