# 谷歌把 AI 概览和 AI 模式揉进一个搜索框，现在能传图、传文件、传视频问问题

> 原标题：谷歌推出全新AI智能搜索框，支持多模态交互

- 来源：AI HOT 精选
- 发布时间：2026-05-19T21:12:37.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/23816
- 原文：https://x.com/GoogleAI/status/2056845506601718271

## 摘要

谷歌上线了一个基于 Gemini 3.5 的新搜索框，把之前的 AI Overviews 和 AI Mode 合并成一个入口。你可以打字、传图片、丢文件或发视频，搜索会跨这些格式一起理解你的问题。支持多轮对话，回答会结合上下文更贴近你。桌面和手机端全球同步上线，正文没披露具体延迟和成本数据。

## 推荐理由

谷歌搜索这次更新，等于把 AI 对话直接嵌进了搜索框，支持文字、图片、文件、视频混着问，还能多轮追问。底层是 Gemini 3.5，把之前的 AI Overviews 和新的 AI Mode 整合在一起，桌面和移动端都上了。对做搜索、做内容、做 AI 产品的人来说，这意味着谷歌的流量分发逻辑在变，跟 Perplexity 那种 AI 搜索的竞争也更直接。不过原文信息偏薄，没写具体交互细节、覆盖地区有没有限制、实际回答质量怎么样，所以重要性我给 86，先别往 90 以上冲。

## 锐评

谷歌这次是把之前分开的 AI 搜索功能统一到一个入口，底层换成 Gemini 3.5，你可以打字、扔图片、丢文件甚至发视频，搜索会跨这些格式理解你的问题，还能多轮对话记住上下文。听起来比之前碎片化的体验顺滑不少，桌面和手机端全球同步上线也算动作快。

但正文完全没提两个关键数字：一次搜索的响应延迟是多少，以及这种多模态推理的算力成本比传统搜索高多少。对用户来说，如果等三五秒才出结果，体验会大打折扣；对谷歌自己，如果每次查询成本是普通搜索的十倍，这个产品能铺多广就要打个问号。另外也没说多轮对话的记忆能保持多久，是单次会话还是跨会话，这对实际好不好用影响很大。

我会先观望一下实测反馈，尤其是复杂多模态查询的准确率和速度，这些才是决定它是不是真比传统搜索好用的硬指标。
