跳到正文
AI HOT 精选

Kimi K3 在漏洞利用测试中大幅落后美国前沿模型,知识蒸馏嫌疑或能解释差距

Kimi K3 在网络安全漏洞利用测试中大幅落后美国前沿模型,知识蒸馏或为原因

英国 AI 安全研究所和美国 CAISI 联合测试了月之暗面的 Kimi K3。在漏洞利用基准 ExploitBench 上,K3 得分 32.2%,而美国头部模型平均 76.2%,且 K3 在 41 个任务中一次都没能实现最高危的“任意代码执行”,美国模型则成功了 20 次。在模拟企业网络攻击的 TLO 测试里,K3 平均只能走完 32 步攻击路径中...

推荐理由:44 个百分点的漏洞利用差距和零次最高危执行,是这篇最扎眼的事实,够得上 featured。知识蒸馏的归因让讨论不止于“输了”,而是“为什么输”,对从业者有信息量。扣分是因为来源单一,且关键细节在付费墙后面,没法交叉验证,所以重要性停在 78。

读原文 ↗导出 Markdown