# Hugging Face 2026 夏季开放模型观察：中国实验室造最大模型，但小模型才是真干活的主力

> 原标题：State of Open Models: Summer 2026 Observations

- 来源：Hacker News 首页
- 发布时间：2026-09-01T14:55:50.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/54097
- 原文：https://huggingface.co/blog/state-of-open-models-summer-2026

## 摘要

Hugging Face 每半年一次的生态报告更新了，这次覆盖 2026 年 1 到 8 月。最直观的变化是，中国实验室几乎每个月都在发布参数规模最大的开放模型，从 754B 一路干到 2.78 万亿参数，而美国实验室除了 NVIDIA 的 Nemotron 3 Ultra（561B）和 Thinking Machines Lab 的 Inkling，...

## 推荐理由

Hugging Face 的半年生态报告本身不是一手发布，但数字和对比框架够硬，三条都踩中了。扣分是因为正文只给了摘要，完整数据得点进去看，所以重要性打了 78 分。

## 锐评

这份报告最值得看的是它把“热闹”和“落地”拆开了。中国实验室确实在参数规模上卷得凶，从 754B 一路干到 2.78 万亿，但报告直接点出，85.6% 的模型一辈子下载量不到 200 次，整个社区 99.2% 的下载量只来自 1.5% 的仓库。换句话说，发布模型和有人用是两码事。

另一个信号是 Qwen 成了社区打底的首选模型，小模型依然是干活的主力，而智能体（让模型进业务流程干活）开始变成模型的新用户。这说明实际应用层在往下沉，不再围着最大的几个模型转。

报告没展开的是，这些超大参数模型的实际推理成本和部署难度到底怎么样，也没给不同规模模型在具体业务场景里的性能对比。这些缺口让“万亿参数”这个数字更像一个技术里程碑，离生产环境还有距离。
