# 面壁开源 MiniCPM5-1B 和训练框架 ForgeTrain，框架代码是 AI 自己写的，1B 模型跑分 17.9

> 原标题：不用人类手写训练框架了！AI自己写代码，训出1B端侧「小钢炮」

- 来源：机器之心 · 公众号
- 发布时间：2026-05-26T05:16:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/28123
- 原文：https://mp.weixin.qq.com/s?__biz=MzA3MzI4MjgzMw==&mid=2651035127&idx=1&sn=1699c9c08063a1f8faf96f5b49fa8c65

## 摘要

面壁智能放出了两个东西：一个叫 MiniCPM5-1B 的端侧小模型，和一个叫 ForgeTrain 的训练框架。1B 模型在 AA-Index 上拿了 17.9 分，这个分数说明小体量也能有不错的综合能力。更特别的是 ForgeTrain，它的训练代码不是人写的，是让 AI 自动生成的，跑出来的结果跟英伟达的 Megatron 框架对得上，而且在 H...

## 推荐理由

HKR 三项都踩中了：AI 写训练框架这个钩子够新鲜，不是又一个千篇一律的模型发布；AA-Index 17.9 分和比 Megatron 快 10% 的 H100 数据让信息有骨头；话题又落在开源小模型和端侧部署上，读者会想点开看。不过它毕竟不是旗舰模型发布，所以分数放在 78 这个区间是合适的。

## 锐评

这条消息最值得看的是 ForgeTrain：训练框架的代码不是人写的，是 AI 自动生成的，而且跑出来的结果能跟英伟达的 Megatron 对齐，在 H100 上还快了 10%。这比单纯发一个 1B 模型有意思——它说明训练基础设施的代码生成，可能比模型本身更早进入“不用手写”的阶段。

MiniCPM5-1B 在 AA-Index 上拿了 17.9 分，这个分数放在 1B 体量里确实不错，说明小模型也能有比较全面的能力。但正文没披露 AA-Index 的具体评测维度、对比对象和误差范围，所以这个分数的含金量还得等更多细节。另外，ForgeTrain 目前只验证了和 Megatron 的结果一致性，没提在更多硬件或更大规模训练下的表现，通用性还不好判断。

整体看，这条消息的亮点在工程自动化，而不是模型能力本身。如果 ForgeTrain 的生成代码真的稳定可用，那训练框架的维护成本会降不少。但现阶段只能说“跑通了”，离“能放心用”还有距离。
