Cactus 给 Gemma 4 加了个“自知之明”探针,只把 15-35% 的难题转给云端模型
Show HN: Cactus Hybrid: We taught Gemma 4 to know when it's wrong
Cactus 团队对 Gemma 4 E2B 做了后训练,让模型每次回答都附带一个 0 到 1 的置信度分数。分数高就在设备上直接出结果,分数低才转给云端模型 Gemini 3.1 Flash-Lite。他们没让模型自己写文字评价自己,也没用 token 熵这种几乎和抛硬币差不多的老办法,而是加了一个只有 6.8 万参数的小探针层。这个探针会读取模型解...
推荐理由:一个具体的工程方案,有数字、有对比、有部署路径,不是概念炒作。没给更高分是因为目前只有 README 说明,缺少大规模评测数据和失败案例,真实表现还得看社区验证。