Mistral推出Voxtral——多語言AI語音模型,性能超越Whisper Large-v3
0
btccSquare新聞:
法國AI公司Mistral發布了專為實用語音智能應用設計的新型AI音頻模型Voxtral。 該模型在性能上超越了領先的開源音頻轉錄解決方案WhisPEr large-v3。 Voxtral由大型語言模型(LLM)Mistral Small 3.1驅動,支援英語、法語、西班牙語等九種語言。
該系統可處理長達30分鐘的音頻輸入進行轉錄,並能理解40分鐘的片段以進行互動問答。 其先進功能包括文本摘要、分析洞察及API驅動的函數執行。 Mistral提供兩種部署選項:生產級Voxtral Small(240億參數)可與GPT-4o-mini和Gemini 2.5 Flash競爭,而邊緣優化的Voxtral Mini(30億參數)則提供具成本效益的本地處理能力。
來源:
登入回覆
登入分享您的看法評論
相關文章
|Square
下載BTCC APP,您的加密之旅從這啟程
立即行動 掃描 加入我們的 100M+ 用戶行列