# 谷歌发布 Gemini 3.5 Flash，专治复杂、跑得久的自动化流程

> 原标题：谷歌发布Gemini 3.5 Flash，专为复杂代理工作流设计

- 来源：AI HOT 精选
- 发布时间：2026-05-19T17:45:39.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/23740
- 原文：https://x.com/JeffDean/status/2056793419033588091

## 摘要

谷歌在 I/O 大会上掏出了 Gemini 3.5 系列的第一个模型 Flash，定位很明确：让模型进业务流程干活，处理那种步骤多、周期长的任务。在 Terminal-Bench 和 MCP Atlas 这两个考编程和代理能力的测试里，它的分数压过了自家上一代的 3.1 Pro。速度方面，比别家顶尖模型快 4 倍，如果放在谷歌自己的 Antigravi...

## 推荐理由

谷歌在 I/O 大会上扔了个 Gemini 3.5 Flash，专门给那种要跑很久、步骤很复杂的 agent 工作流用的。我会先打个折：跑分是谷歌自己给的，第三方还没复现，但 Terminal-Bench 上超 3.1 Pro、速度是其他前沿模型 4 倍这些数字，如果属实确实省钱省时间。Antigravity 环境里飙到 12 倍，这点先别太激动，正文没披露那是啥场景、跟谁比。整体看，这是个同日发布的重要模型更新，对做 agent 落地的人有直接参考价值，但还没到改写行业规则的程度。

## 锐评

谷歌这次把 Gemini 3.5 Flash 定位得很清楚：不是聊天机器人，是塞进业务流程里干活的。它要处理的是步骤多、周期长的任务，比如让多个子代理协同工作、反复迭代去解决实际问题。在 Terminal-Bench 和 MCP Atlas 这两个考编程和代理能力的测试里，分数压过了自家上一代 3.1 Pro，说明在代码执行和工具调用上确实有提升。速度方面，比别家前沿模型快 4 倍，用谷歌自己的 Antigravity 环境能飙到 12 倍，这对跑长流程来说成本优势明显。

不过正文没披露具体延迟是多少毫秒、任务完成率有多高，也没说对比的是哪些“别家前沿模型”。快 12 倍是在 Antigravity 这个特定环境下的数字，换到别的地方还能不能保持，不知道。另外，代理工作流最怕中间步骤出错后没法恢复，模型能不能自己纠错、容错能力怎么样，这些都没提。建议等看到实际业务场景的跑分和失败案例再下判断。
