# OpenAI 放出一个实时翻译语音模型，70 多种语言输入，13 种语言输出

> 原标题：OpenAI推出实时翻译模型，支持70+语言输入

- 来源：AI HOT 精选
- 发布时间：2026-05-29T20:03:55.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/30448
- 原文：https://x.com/gdb/status/2060452095279415725

## 摘要

OpenAI 发了 gpt-realtime-translate，一个专门做语音翻译的模型。你对着它说 70 多种语言里的任意一种，它能直接用 13 种目标语言把语音播出来。OpenAI 说大模型虽然强，但特定任务还是得上专用模型。目前这个功能已经在智能眼镜上跑起来了，不过正文没披露延迟、准确率和具体硬件细节。

## 推荐理由

我会先打个折：正文没提延迟、定价和 API 开放时间，所以实际能不能用、贵不贵还不知道。但 OpenAI 把实时翻译塞进智能眼镜，70多种语言进、13种语言出，这个组合本身是个挺实在的进展，值得从业者看一眼。

## 锐评

OpenAI 这次没拿通用大模型硬套翻译，而是专门训了个 gpt-realtime-translate，思路是对的：实时语音翻译对延迟和稳定性要求极高，通用模型往往顾不过来。它支持 70 多种输入语言，但输出只覆盖 13 种，说明目前重点在主流语种上，小语种输出还没跟上。

官方说已经在智能眼镜上跑起来了，这是个关键场景——眼镜是离嘴和耳朵最近的设备，翻译做好了确实顺手。但正文完全没披露端到端延迟、字错率、不同口音下的表现，也没说是哪款眼镜、本地跑还是云端跑。这些数据直接决定它能不能真用，而不是又一个酷炫 demo。

另外，专用模型意味着它可能比通用模型更省算力，但 OpenAI 没给任何成本或推理速度的对比。如果延迟能压在 300 毫秒以内，准确率接近人工同传的 90% 左右，那才算有杀伤力。现在只能说方向对了，落地程度还得等实测。
