# 软件工程师用 AI 检索历史档案，找到被遗忘的陨石、犀牛与火山喷发记录

> 原标题：Pointing AI at archives found a forgotten meteorite, lost rhinos, and more

- 来源：Hacker News 首页
- 发布时间：2026-10-09T11:36:20.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/e7sl283bjhq0vao535j9ernrx
- 原文：https://jessewaites.com/blog/post/i-pointed-ai-at-400-years-of-archives/

## 摘要

一名软件工程师用 AI 检索数百万页历史档案，找到一份陨石报告、3 只犀牛的运输记录及3 起火山喷发候选记录。流程结合语义检索、Jev 初筛、Claude Haiku 精读和 Claude Code 核查原始扫描，并用已知历史事件测试检索能力。主要发现已对照原始页面及可访问的目录，但尚未经相关专家审查；作者正将调查工作流作为 Antiquity 工具包开源。

## 推荐理由

软件工程师将语义检索、低成本模型筛选与原始扫描核查串联，并用已知事件测试检索流程，为海量档案调查提供可迁移的方法。

## 锐评

拿每百万词几美分的小模型当第一道筛子，这套工作流的账算得极聪明。

读 5.9 万次大象记录只花了 3 美元，后面 Claude Haiku 和 Claude Code 只要精读过滤出的几十页。跑海量文档检索很容易一上来就调贵模型，435 万页档案光 token 费就能把人劝退。把大批脏活卡在几美分这个档位，省下来的钱才够支撑大模型去核查原始扫描件。能把 400 年历史档案翻个底朝天，全靠这笔账算得过来。
