# Mistral 发布 Voxtral 语音理解模型，24B 与 3B 双版本开源

> 原标题：Voxtral

- 来源：Mistral AI
- 发布时间：2025-07-15T12:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/m6bdwr4l0konj30cgdjbshmtf
- 原文：https://mistral.ai/news/voxtral/

## 摘要

Mistral 发布 Voxtral 语音理解模型，提供 24B 和 3B 两个版本，均以 Apache 2.0 许可开源并上线 API。模型支持 32k token 上下文，可处理最长 30 分钟转写或 40 分钟理解，具备内置问答与摘要、多语言识别和语音函数调用能力，并保留 Mistral Small 3.1 的文本能力。

## 推荐理由

Mistral 开源两款语音理解模型，给出 32k 上下文、函数调用等能力与低于同类 API 一半的定价，便于评估语音方案选型。

## 锐评

Mistral 把语音理解模型开源了，24B 和 3B 两个版本都挂 Apache 2.0，API 每分钟 $0.001。这个价格是冲着 Whisper 和 ElevenLabs Scribe 去的——官方说不到同类一半。

但我会先打个折：benchmark 全是 Mistral 自己跑的，第三方还没复现。32k 上下文、30 分钟转写这些数字好看，实际落地效果得等社区测完再说。
