跳到正文
AI HOT 精选

Ornith-1.0 开源模型家族发布,专做编程智能体,从 9B 到 397B 全都有

Ornith-1.0 开源模型家族发布,专注 Agentic Coding 全参数规模

Ornith-1.0 是一套专门为“让模型自己动手写代码、改代码、跑命令”设计的开源模型,覆盖 9B、31B 两个稠密版和 35B、397B 两个混合专家版,全部 MIT 协议。它在 SWE-Bench Verified 上拿了 82.4 分,Terminal-Bench 2.1 上 77.5 分,都是开源里目前最高的。训练方法有点意思:用强化学习同时...

推荐理由:我会先打个折:分数是官方自己报的,还没看到第三方复现或真实项目里的反馈,所以别急着当定论。但四个尺寸全 MIT 协议、同时刷高 SWE-Bench 和 Terminal-Bench 两个榜,对做编程 agent 的人来说确实解渴——不用再拿通用模型硬改,也不用担心许可证卡脖子。训练上把代码生成和终端操作放一起用 RL 优化,思路比单刷代码榜更贴近实际 agent 工作流。正文没披露训练数据和具体 RL 细节,这点先别太激动。

读原文 ↗导出 Markdown