跳到正文
原文
Sarvam AI·· 11 天前AI 評分66

Sarvam AI 發佈 Saaras V4 語音識別模型

Introducing Saaras V4

AI 導讀

Sarvam AI 發佈 Saaras V4 語音識別模型,稱其在 22 種印度語言達到 SOTA,並支援五種轉寫格式。模型結合音訊編碼器與從零開始訓練的 3B 混合狀態空間 LLM 解碼器,在七個英語基準測試中取得最低平均 WER。Saaras V4 支援低延遲串流,首個 token 延遲低於 150 ms。

來源:Sarvam AI · sarvam.ai