# Google 放出 Gemini 3.5 Live Translate，话没说完就开始翻，支持 70 多种语言

> 原标题：Google 发布 Gemini 3.5 Live Translate 实时语音翻译模型

- 来源：AI HOT 精选
- 发布时间：2026-06-09T15:47:10.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/36648
- 原文：https://x.com/rohanpaul_ai/status/2064373746635592188

## 摘要

Google 发了 Gemini 3.5 Live Translate，一个实时语音转语音翻译模型。它不等对方把整句话讲完，边听边翻，用流式更新把结果推出来，延迟压到几秒，还能保留原声的语速、音高和语调。支持 70 多种语言，目前通过 Gemini Live API、Google Meet 预览版和 iOS/Android 的 Google 翻译 Ap...

## 推荐理由

HKR 三项都成立：Google 把实时语音翻译绑定了 70+ 语言和说话人未结束就开始的流式输出。分数留在 82，因为正文没披露具体上线范围、定价和基准测试结果，实际效果和可用性还得等验证。

## 锐评

Gemini 3.5 Live Translate 做的是语音到语音的流式翻译，不等对方把话说完就开始出结果，边听边更新，延迟压到几秒。它还能保留原声的语速、音高和语调，这点比传统翻译机那种机械朗读强一截。支持 70 多种语言，覆盖范围够广，目前通过 Gemini Live API、Google Meet 预览版和手机上的 Google 翻译 App 落地。

但正文没披露几个关键数字：具体延迟是 2 秒还是 5 秒？不同语言对之间的准确率差多少？流式更新时会不会频繁改口，导致听感混乱？这些直接决定它能不能用在商务会议或医疗问诊这种容错率低的场景。另外，保留原声语调听起来很酷，但实际效果是自然还是诡异，没样本没法判断。

我会先打个折：这更像一个工程整合，把流式识别、翻译和语音合成串起来，而不是模型本身有质的飞跃。真正值得盯的是它在嘈杂环境下的表现，以及长对话里会不会越翻越歪。这些正文都没提。
