# Google I/O 2026：Gemini 3.5 Flash 发布，百万 token 上下文、四种思考模式，主打编程和干活快

> 原标题：[AINews] Google I/O 2026: Gemini 3.5 Flash, Omni (NanoBanana for Video), Spark (background agents), and Antigravity 2.0

- 来源：Latent Space
- 发布时间：2026-05-20T03:34:17.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/26930
- 原文：https://www.latent.space/p/ainews-google-io-2026-gemini-35-flash

## 摘要

Google 在 I/O 大会上把 Gemini 重新定位成消费级 AI 入口和开发者代理平台。最核心的发布是 Gemini 3.5 Flash，今天就能用，上下文窗口 100 万 token，单次最多输出 6.5 万 token，提供“极简/低/中/高”四档思考深度，并且能在多轮对话里保留思考过程。官方说它比 3.1 Pro 更强，尤其在终端操作、编...

## 推荐理由

Google I/O 这次不是单点发布，是把模型、视频、agent 和开发工具打包一起推。Gemini 3.5 Flash 的定价和上下文窗口摆在那，对做应用的人有直接参考价值；Omni 的视频理解和 Spark 的后台 agent 思路，跟现在行业里追的 agent 落地、多模态成本是同一根神经。我会先打个折——现场 demo 和实际 API 稳定性之间通常有差距，但信息量够、时间点敏感，放 P1 没问题。

## 锐评

这次 I/O 最实在的发布是 Gemini 3.5 Flash，今天就能用，不是画饼。它把上下文窗口拉到 100 万 token，单次最多能吐 6.5 万 token，还给了“极简/低/中/高”四档思考深度，让开发者按延迟和成本自己选。定价是输入每百万 token 1.5 美元，输出 9 美元，比 3.1 Pro 便宜一截，对做终端操作和代码生成的场景挺友好。

但要注意，所有性能对比都来自 Google 官方口径，说它比 3.1 Pro 强，尤其在 agent 和编程任务上。第三方基准测试机构 Artificial Analysis 的独立跑分还没出来，实际推理质量和稳定性得等社区验证。另外，多轮对话里保留思考过程这个功能，听起来能省 token，但正文没披露具体怎么实现、会不会引入新的延迟。

Omni 视频生成和 Antigravity 2.0 的 agent 套件看着热闹，但大部分还在“即将推出”阶段。Spark 后台 agent 跑在云虚拟机上，能脱离前台干活，这个思路对，但可靠性、任务完成率和资源消耗都没给数据。整体看，Google 这次把模型能力铺得很开，但落地效果还得看接下来几周开发者的真实反馈。
