# GPT-Live 实时音频新架构：边听边说，推理和工具调用不再打断对话

> 原标题：GPT-Live实时音频新架构发布

- 来源：AI HOT 精选
- 发布时间：2026-08-03T22:25:53.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/48512
- 原文：https://x.com/gdb/status/2084405421041963356

## 摘要

OpenAI 公布了 GPT-Live，一套从客户端到模型全部重写的实时音频方案。核心变化是模型能在说话的同时继续听你说话，音频流不会断。以前一调用工具或做深度推理，对话就会卡住，现在这个中断被干掉了。正文没披露延迟、成本和上线时间，所以实际体验和开销还得等后续信息。

## 推荐理由

OpenAI 把实时音频从客户端到模型整个重写了一遍，最大的卖点是模型说话时还能同时听你说话，调用工具或做深度推理也不会中断音频流——这正好打中了之前语音交互最让人抓狂的痛点。我会先打个折，因为正文没披露延迟、成本和上线时间，实际体验和开销还得等后续信息，所以分数没给到 85 以上。

## 锐评

OpenAI 这次动的是实时语音交互里一个很烦人的问题：模型在调用工具或做复杂推理时，对话会卡住，你得等它想完才能继续说话。GPT-Live 把整个语音栈从客户端到模型都重写了，让音频流不中断，模型可以边说话边听你讲。这听起来像把半双工对讲机升级成全双工电话，对需要连续对话的场景——比如实时协作或客服——体验提升会很明显。

但正文没披露任何硬指标。延迟是多少毫秒？端到端成本涨了多少？这些直接决定能不能在 ChatGPT 这种体量下跑起来。也没说什么时候上线，所以现在只能当技术方向看。如果是真的做到低延迟、成本可控，那实时语音 agent 的门槛会降一截；如果只是 demo 阶段，那就还得等。
