Gemini Omni:谷歌新模型,先拿视频开刀,号称什么输入都能生成内容
Gemini Omni:从任意输入创造内容的新模型
谷歌发了条推文介绍 Gemini Omni,说这个模型能从任意输入生成内容,首发支持视频。正文没披露参数量、定价、上线时间,也没给任何跑分数据。我会先打个折:目前只有一段营销推文和一条线索串,实际能力、成本和延迟全都不清楚。
推荐理由:Google AI 发了一条 Gemini Omni 的预告帖,核心卖点是“从任意输入创造内容”,听着像是要把视频、音频、文本这些全揉进一个生成入口里。我会先打个折:正文没披露参数、没提定价、没给可用时间,也没贴任何基准测试结果,所以现在只能当概念验证看。如果是真的,对做多模态产品的团队来说挺省事,但没见到具体东西之前,这点先别太激动。