# Hugging Face 接入 VirusTotal，给 Hub 上 220 万个模型和数据集仓库做恶意文件扫描

> 原标题：Hugging Face and VirusTotal collaborate to strengthen AI security

- 来源：Hugging Face 博客
- 发布时间：2025-10-22T00:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/697
- 原文：https://huggingface.co/blog/virustotal

## 摘要

Hugging Face 宣布和 VirusTotal 合作，开始持续扫描 Hub 上超过 220 万个公开的模型和数据集仓库。你打开仓库或文件页面时，Hub 会自动比对文件哈希值，从 VirusTotal 拉回该文件是否被标记为恶意、有多少家引擎报毒，以及相关的威胁情报。整个过程不会把原始文件内容发给 VirusTotal。这相当于在下载前多了一道安...

## 推荐理由

HKR 三项都站得住：220 万仓库的扫描规模、基于哈希的轻量集成方式、以及把威胁判断前移到下载环节，对从业者来说都是直接可用的信息。没进必写是因为正文没披露误报率、扫描延迟和后续处置流程，这几个缺口会让实际落地效果打个折扣，先别太激动。

## 锐评

这事说白了就是 Hugging Face 在下载页直接嵌入了 VirusTotal 的检测结果，你点开一个模型或数据集仓库，Hub 会自动比对文件哈希值，告诉你这个文件有没有被各家杀毒引擎标记过、标记了多少次。整个过程不传原始文件，只传哈希，隐私上说得过去。覆盖范围是 220 多万个公开仓库，量不小。

但正文有几个关键信息没给。第一，没提误报率。VirusTotal 是多引擎聚合，经常出现一两家小厂报毒、其他全绿的情况，这种“1/70”的标记到底算不算恶意，Hub 上怎么展示、用户怎么理解，完全没说。第二，没提扫描延迟。是实时查还是定期批量跑，文件刚上传多久能出结果，这些都不清楚。第三，没提后续处理流程。如果真扫出恶意文件，是自动下架还是通知作者，用户能不能申诉，一概没写。

所以这个功能更像是多了一道“查前科”的提示，不是实时安全审计。对日常下载的人来说，能提前避坑是好事，但别把它当成模型安全的完整方案。
