# 英伟达开源 Cosmos 3：一个能看懂物理世界、还能生成动作的 32B 模型

> 原标题：Cosmos 3发布：首个开放物理AI全能模型

- 来源：AI HOT 精选
- 发布时间：2026-06-01T04:46:42.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/31495
- 原文：https://x.com/NVIDIAAI/status/2061308434629132553

## 摘要

英伟达把 Cosmos 3 称为第一个完全开放的物理 AI 全能模型，意思是它不只能识别图像，还内置了视觉推理、生成 3D 世界状态和直接输出动作的能力。这次放出两个尺寸：Super 版 320 亿参数，Nano 版 80 亿参数。正文没提训练数据规模、具体跑分和推理成本，所以实际能用多好、跑起来贵不贵还得等实测。

## 推荐理由

我会先打个折：正文是单篇发布稿，没给基准测试、没提许可证细节，也没说训练数据规模和实际部署条件，所以分数卡在 78–84 区间。亮点在于 NVIDIA 第一次把视觉推理、世界生成和动作生成打包成一个开放物理 AI 模型，并给出两个具体尺寸，这对机器人圈子的信号意义不小。但缺少验证信息，这点先别太激动。

## 锐评

英伟达把 Cosmos 3 定位成“首个完全开放的物理 AI 全能模型”，意思是它不光是视觉模型，还内置了视觉推理、生成 3D 世界状态和直接输出动作的能力，相当于让模型从“看懂画面”一步跨到“理解物理世界并动手干活”。这次放出两个尺寸：Super 版 320 亿参数，Nano 版 80 亿参数，小尺寸明显冲着端侧部署去的。

但正文没披露任何跑分、训练数据规模、推理延迟或硬件需求，所以“全能”到底能到什么程度、跑起来贵不贵，全是未知数。开放是开放了，可如果实际效果撑不住或者部署成本太高，这个“首个”的含金量就得打折。

还缺的东西很关键：跟上一代 Cosmos 的对比、在具体机器人或仿真任务上的成功率、以及社区能复现到什么程度。等有人跑通实测再下结论不迟。
