# 谷歌发布 Gemini 3.5 Flash，输出速度跑到每秒 289 个 token，是 GPT-5.5 的四倍

> 原标题：谷歌发布 Gemini 3.5 Flash 模型：AI 输出速度 4 倍于 GPT-5.5

- 来源：AI HOT 精选
- 发布时间：2026-05-19T17:38:57.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/23744
- 原文：https://www.ithome.com/0/952/522.htm

## 摘要

谷歌在 I/O 大会上推出了 Gemini 3.5 Flash，官方说它在很多基准测试里比自家 3.1 Pro 强。最直观的卖点是快：输出速度达到每秒 289 个 token，对比的是 Claude Opus 4.7 和 GPT-5.5 xhigh，快了大约四倍。谷歌内部还用 Antigravity 工具做了个实验，让 93 个子智能体协作，12 小时...

## 推荐理由

谷歌在 I/O 上扔了个速度炸弹：Gemini 3.5 Flash 每秒吐 289 个 token，号称是 GPT-5.5 xhigh 和 Claude Opus 4.7 的四倍。这个数字对做应用的人很直观——响应更快、排队更短、按 token 算钱可能也更省。不过正文没提价格、上下文窗口多大、以及能力上限在哪，所以先别把它当成全面碾压，目前就是个单项速度领先。

## 锐评

谷歌在 I/O 大会上扔出的 Gemini 3.5 Flash，核心卖点就一个字：快。每秒 289 个 token，比 Claude Opus 4.7 和 GPT-5.5 xhigh 快了大约四倍。这个数字对需要低延迟的场景确实有吸引力，比如实时对话或批量跑任务。但文章只给了速度对比，没放任何基准测试的具体分数，只说“比自家 3.1 Pro 强”——这等于没比。

另一个值得看的是内部用 Antigravity 工具做的实验：93 个子智能体协作，12 小时生成 26 亿个 token，搭出一个能跑的操作系统内核。听着很唬人，但正文没披露这个系统的复杂度、代码质量或后续验证结果，更像是一次工程极限测试，离实用还有距离。

整体来看，这条消息的价值在于速度指标和智能体协作的尝试，但缺了质量评估和成本数据，没法判断是“真快又好”还是“牺牲质量换速度”。
