# NVIDIA 一口气开源了一堆模型、数据和工具，覆盖智能体、机器人、自动驾驶和生物医药

> 原标题：NVIDIA Unveils New Open Models, Data and Tools to Advance AI Across Every Industry

- 来源：NVIDIA 博客
- 发布时间：2026-01-05T21:50:50.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/3407
- 原文：https://blogs.nvidia.com/blog/open-models-data-tools-accelerate-ai/

## 摘要

NVIDIA 在 2026 年 1 月 5 日放出了一批新的开源模型和数据集。语言模型方面，有 Nemotron 系列的新成员，专门做语音、外挂资料库（RAG）和安全对齐；还有一个叫 Alpamayo 1 的模型，正文没具体说它擅长什么。物理 AI 这边，Cosmos 系列更新了 Reason 2、Transfer 2.5 和 Predict 2.5 ...

## 推荐理由

NVIDIA 这次不是发一篇通稿，而是把 Nemotron、Cosmos、GR00T、Clara 几条线的模型、数据集和工具一起开源了。我会先打个折：所有信息都来自厂商自己，没有第三方验证，实际可用性还得看后续社区反馈。但光看披露的数字——10 万亿 token 文本、50 万条机器人轨迹、100TB 车载数据、45.5 万个蛋白结构——规模确实够大，而且覆盖了代理、物理 AI、自动驾驶和生命科学几个热门方向。具体到模型，Nemotron Speech 做语音、Cosmos Reason 2 做推理、GR00T N1.6 做人形机器人、Alpama...

## 锐评

NVIDIA 这次把家底掏出来不少，从语言模型到物理 AI 的数据集都开源了。语言模型这边，Nemotron 系列新增了语音、外挂资料库和安全对齐三个方向，还有一个叫 Alpamayo 1 的模型，正文没具体说它擅长什么，这点先别太激动。物理 AI 是重头戏，Cosmos 系列更新了三个版本，GR00T N1.6 专门做机器人控制，还放出了 50 万条机器人运动轨迹和 10 万小时的自动驾驶传感器数据。生物医药那边给了 45.5 万个蛋白质结构。

这些数字看着大，但关键要看数据质量和任务覆盖度。比如 50 万条机器人轨迹，如果都是单一场景重复采集，实际能用的可能打个折。正文没披露这些模型在标准基准上的跑分，也没说训练用了多少算力，所以没法判断跟现有开源方案比到底强多少。

还缺什么：每个模型的具体参数量、推理延迟、以及跟 Llama、Qwen 等主流开源模型的横向对比。如果只是把内部用的东西打包放出来，社区能不能接得住、改得动，还得看后续文档和工具链跟不跟得上。
