Anthropic 发布 2026 年 9 月威胁情报报告,披露 Claude 被滥用于网络攻击、监控和舆论操纵等七类活动
Detecting and countering misuse of AI: September 2026
Anthropic 在 2025 年 12 月到 2026 年 8 月期间,发现并打断了七类滥用 Claude 的行为:网络攻击、监控、舆论操纵、诈骗、生物武器、常规武器开发和非法蒸馏(即未经授权把大模型的能力偷出来训练自己的模型)。报告里最扎眼的一个判断是,AI 把技术门槛打下来了——以前需要国家级团队才能搞的多目标攻击,现在单个人就能干。公开的攻击...
推荐理由:Anthropic 的官方威胁情报报告,覆盖七类滥用,有具体打断案例。扣一点分是因为这是定期报告,不是突发新闻,而且正文摘要里没给具体的攻击手法细节,想看完整案例得去翻 PDF。