Mistral AI 发布 Voxtral Transcribe 2 系列语音转文字模型，其一延迟不足 0.2s-网络资讯-红帽SEO工作室

当前位置：红帽SEO工作室网络资讯 Mistral AI 发布 Voxtral Transcribe 2 系列语音转文字模型，其一延迟不足 0.2s

→ 源码教程下载地址见 →右侧下载链接 →点“登录购买”→注册登录购买后可见→
→ 这里没有广告，只有干货！给力项目更多教程，点此加入VIP会员,即可免费下载！
→ 每日分享你意想不到的网络思维！加入红帽VIP会员，感受一下网络赚钱的快感，点击进入了解。

2 月 5 日消息，Mistral AI 当地时间昨日发布两款 Voxtral Transcribe 2 系列模型，包括面向批量处理的 Voxtral Mini Transcribe V2 和用于实时转录的 Voxtral Realtime，其中后者以 Apache 2.0 许可开放权重形式公开。

Voxtral Realtime 参数规模为 4B，专为对延迟要求严格的应用场景而设计，其采用了一种全新的流式架构，可在音频到达时立即进行转录，能将转录延迟压缩至 200ms 以下。

另一方面，Voxtral Mini Transcribe V2 拥有目前性价比最高的转录 API，准确率表现优于 GPT-4o mini Transcribe、Gemini 2.5 Flash，单次请求可处理长达 3 小时的录音。

这两款模型均支持包含中文在内的 13 种语言。定价上，Voxtral Mini Transcribe V2 的 API 价格为每分钟 0.003 美元，Voxtral Realtime 则为每分钟 0.006 美元。

温馨提示：
1、如非特别声明，本内容转载于网络，版权归原作者所有！
2、本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。
3、本内容若侵犯到你的版权利益，请联系我们，会尽快给予删除处理！
我要投诉
红帽SEO工作室 » Mistral AI 发布 Voxtral Transcribe 2 系列语音转文字模型，其一延迟不足 0.2s

分享到：