# Gemini Omni 发布：先拿视频生成试水，目标是“什么都能生成”

> 原标题：Gemini Omni发布：多模态生成新突破

- 来源：AI HOT 精选
- 发布时间：2026-05-19T17:17:56.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/23749
- 原文：https://x.com/GoogleDeepMind/status/2056786446636212467

## 摘要

Google DeepMind 发了条推，说 Gemini Omni 是他们朝“用任何内容生成任何内容”迈出的第一步，首发功能是视频生成。它把 Gemini 的理解能力和自家的生成式媒体系统揉在一起，号称在多模态理解和编辑上有大跨步。但正文没披露模型参数、价格和什么时候能用，我会先打个折——目前只有一句口号和一段视频演示，具体效果和限制还得等后续公开。

## 推荐理由

我会先打个折：正文没披露参数量、价格和开放时间，所以没法判断实际成本和可用性。但 HKR 三项都过关——DeepMind 用 Gemini 品牌推视频生成，切入点清楚，技术路线也说了（模型加生成系统），而且直接踩在视频生成的热门赛道上。信息缺口让分数停在 72–77 这个区间，不算高但合理。

## 锐评

Google DeepMind 在推上宣布了 Gemini Omni，说这是他们朝“用任何内容生成任何内容”迈出的第一步，首发功能是视频生成。它把 Gemini 的理解能力和自家的生成式媒体系统揉在一起，号称在多模态理解和编辑上有大跨步。但正文没披露模型参数、价格和什么时候能用，我会先打个折——目前只有一句口号和一段视频演示，具体效果和限制还得等后续公开。

这条消息的信息量很薄，更像预告而非产品发布。没给技术细节，也没说视频生成的分辨率、时长、可控性，更没提和现有视频模型（比如 Sora、Veo）的对比。对从业者来说，最关心的训练成本、推理延迟、是否开源或提供 API，全都没提。

还缺的是实际用例和限制说明。视频生成容易出幻觉和物理不一致，Omni 在这块有没有改进，正文完全没说。建议等官方放出论文、demo 或定价后再判断，现在只能当个方向信号看。
