跳到正文
Hacker News 首页

Jev:一个只输出概率、不写句子的“系统一”模型,主打校准度而非准确率

Jev and System One Models: Calibration Beats Accuracy

TypeSafe AI 发布了 Jev,一个非自回归的“系统一”模型。它不聊天、不写文章、不逐步推理,而是对输入的结构化问题一次性给出答案,并附上每个答案的概率。作者认为,对于生产环境中的分类器,真正的瓶颈不是准确率,而是校准度——即模型给出的概率是否诚实。Jev 的训练目标(RLCD)直接优化这个。它的延迟是 70–500 毫秒,每百万输入 toke...

读原文 ↗导出 Markdown