开发者社区

文档建议反馈控制台

文章/答案/技术大牛

发布

Mistral 推出 Voxtral 语音理解模型：以开源提供出色正确率表现

文章来源：企鹅号 - IT之家

IT之家 7 月 16 日消息，Mistral AI 当地时间昨日公布了其 Voxtral 语音理解模型。该系列模型以开源形式推出，可以更低价格提供领先的低错误率表现，支持真实世界的语音智能生产应用。

Voxtral 系列模型由 Mistral Small 3.1 派生而来，包括面向生产应用的 24B 版本 Voxtral Small 和适用于本地 / 边缘部署的 3B 版本 Voxtral Mini，此外还有仅具备语音转文字功能的 Voxtral Mini Transcribe。

该模型支持 32K Token 的上下文长度，可处理 30 分钟音频转录或 40 分钟音频理解，内置生成相关问题、结构化摘要的能力，支持英语、西班牙语、法语、葡萄牙语、印地语、德语、荷兰语、意大利语等印欧诸语言。

Mistral AI 宣称 Voxtral Mini Transcribe 在成本敏感用例中性能优于 OpenAI Whisper，而价格不到后者的一半；而在高级用例方面，Voxtral Small 的性能与本领域顶尖模型 ElevenLabs Scribe 接近，价格也不到一半。

发表于: 2025-07-162025-07-16 17:00:07
原文链接：https://page.om.qq.com/page/O9LzAbpEZtrgMf7M2u1brUYg0
腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号（企鹅号）传播渠道之一，根据《腾讯内容开放平台服务协议》转载发布内容。
如有侵权，请联系 cloudcommunity@tencent.com 删除。

相关快讯