开源模型网络攻击力追近闭源,Kimi K3 发布,Hassabis 提 AGI 监管方案
Import AI 465: Open vs closed gaps; Kimi K3; Demis’ big policy plan
英国 AI 安全研究所(AISI)的测试显示,开源模型在网络安全任务上与闭源前沿模型的差距已从 2025 年的 6 到 10 个月,缩短到现在的 4 到 7 个月。具体来说,GLM-5.2 在 70 项细分网络能力评估中,表现接近 4.3 个月前发布的 Claude Opus 4.6;但在需要把多种能力串起来完成完整黑客操作的长时间任务上,差距会拉大,...
推荐理由:AISI第一次公开量化开源与闭源模型在网络能力上的时间差,有具体模型和月份数字,虽然只是网络安全这一个维度,但数据本身够硬,值得从业者关注。