Meta 和 Google 模型的安全护栏几分钟内就被扒掉了
AI guardrails stripped from Meta and Google models in minutes
有软件能让模型回答生物武器和恶意软件的问题,但正文没披露具体是哪些模型、怎么复现、用了什么工具,也没提两家公司有没有应对措施。
推荐理由:标题很炸,但正文信息量偏薄。我会先打个折:它只说了有软件能诱导模型输出危险内容,没披露具体是 Meta 和 Google 的哪款模型,也没给复现步骤或缓解方案。这点先别太激动,因为缺了这些技术细节,从业者看完也不知道自己该查什么、怎么防。不过“几分钟拆护栏”这个事实本身,加上涉及两家大厂,已经足够让做安全的人警觉,所以 featured 没问题,只是离必写还差一口气。