# Gemini Omni：谷歌新模型，先拿视频开刀，号称什么输入都能生成内容

> 原标题：Gemini Omni：从任意输入创造内容的新模型

- 来源：AI HOT 精选
- 发布时间：2026-05-19T19:17:58.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/23800
- 原文：https://x.com/GoogleAI/status/2056816653770625406

## 摘要

谷歌发了条推文介绍 Gemini Omni，说这个模型能从任意输入生成内容，首发支持视频。正文没披露参数量、定价、上线时间，也没给任何跑分数据。我会先打个折：目前只有一段营销推文和一条线索串，实际能力、成本和延迟全都不清楚。

## 推荐理由

Google AI 发了一条 Gemini Omni 的预告帖，核心卖点是“从任意输入创造内容”，听着像是要把视频、音频、文本这些全揉进一个生成入口里。我会先打个折：正文没披露参数、没提定价、没给可用时间，也没贴任何基准测试结果，所以现在只能当概念验证看。如果是真的，对做多模态产品的团队来说挺省事，但没见到具体东西之前，这点先别太激动。

## 锐评

这条消息目前只能当预告看。谷歌说 Gemini Omni 是“从任意输入创造内容”的新模型，首发支持视频，但推文里没披露任何硬指标：参数量未知，定价没提，上线时间也没说，更没有任何基准测试结果。唯一的信息来源是一条推文和一条线索串，连技术博客或 demo 链接都没有。

“任意输入到任意输出”这个说法听着很全能，但实际能做到什么程度、延迟多高、成本多大，全都不清楚。视频生成或理解对算力要求很高，如果谷歌没给效率数据，就没法判断这是实验室 demo 还是快能用的产品。

我会先打个折：等有论文、定价或实际可测的接口出来再认真看。现在这条消息的价值在于知道谷歌在往这个方向走，但离“能用”还差关键信息。
