# Google DeepMind 发布 Gemini Omni Flash 视频生成模型

> 原标题：Introducing Gemini Omni

- 来源：Google DeepMind
- 发布时间：2026-05-17T19:50:57.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/htjpcbw1n6btoszobksdcno6r
- 原文：https://deepmind.google/blog/introducing-gemini-omni/

## 摘要

Google DeepMind 发布 Gemini Omni 家族首个模型 Gemini Omni Flash，可组合图像、音频、视频和文本输入生成高质量视频，并通过自然语言多轮编辑。

## 推荐理由

Gemini Omni Flash 把视频生成与对话式编辑合并到同一模型，读者可据此判断多模态创作入口的变化。

## 锐评

Google 把视频生成做成了对话式编辑，Gemini Omni Flash 今天直接铺到 Gemini app、Flow 和 YouTube Shorts。真正值钱的不是生成质量，是"每句指令叠加在上一条上"——角色一致、物理不崩、场景记得住前面。这是把视频剪辑从时间轴拖拽改成聊天。

但正文没给任何 benchmark、分辨率、时长或生成成本，全是 prompt 演示。对比 Nano Banana 当初也是先放效果再补参数，我会先打个折：等 API 价格出来再判断它是不是真能替代现有剪辑流程。
