# Mistral 发布 Voxtral Transcribe 2 语音转写模型家族

> 原标题：Voxtral transcribes at the speed of sound.

- 来源：Mistral AI
- 发布时间：2026-02-04T16:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/v0rhfu31vz899a0cse4zjapkz
- 原文：https://mistral.ai/news/voxtral-transcribe-2/

## 摘要

Mistral 发布 Voxtral Transcribe 2，包含面向批量转写的 Voxtral Mini Transcribe V2 和面向实时场景的 Voxtral Realtime 两款语音转文字模型。

## 推荐理由

原文给出两款语音转写模型的延迟、价格与开源许可，可据此判断实时语音应用的选型空间。

## 锐评

Mistral 把实时语音的价格锚点砸下来了：Voxtral Realtime 延迟可调到 200 毫秒以内，4B 参数，Apache 2.0 开源，能跑在边缘设备上。批量版 Mini Transcribe V2 报 FLEURS 约 4% 词错率、每分钟 $0.003，比 GPT-4o mini Transcribe、Gemini 2.5 Flash、Deepgram Nova 都准。

但 200 毫秒这个数得看条件：正文说 480 毫秒延迟时词错率掉 1-2 个百分点，真卡到 200 毫秒以下质量没给数。4% 和 $0.003 都是厂商自报，第三方复现还没看到。
