Mistral AI 发布开源语音理解模型 Voxtral
Mistral AI 发布了开源语音理解模型 Voxtral,包含面向生产的 24B 规格与面向端侧的 3B 规格,均采用 Apache 2.0 协议开源。该系列模型支持 32k 上下文、长达 30 至 40 分钟的音频处理、内置问答与摘要、多语言处理及函数调用功能,并在多项语音转写和理解基准测试中表现优异。
Why Recommended: 该模型提供了两种尺寸并开源,读者可以根据自身算力条件选择合适的版本进行本地部署或调用 API。