跳到正文
Hacker News 首页

Dream-RSI:让AI在“梦境”里自我改进,省掉大量在线试错成本

Dream-RSI: Recursive Self-Improvement through Evolving Worlds

这篇论文提出一种让AI自我改进的新方法,核心是把过去探索的记录(比如搜索路径、试错结果)变成一个“回放模拟器”,让AI在这个模拟器里离线评估和优化自己的搜索策略,而不需要每次都跑到真实环境里做昂贵的在线实验。在算法工程、数学优化和GPU内核工程三个任务上,Dream-RSI的发现质量与现有方法持平或更好,但成本更低。论文没有给出具体的节省比例,但思路很...

读原文 ↗导出 Markdown