跳到正文
原文
OpenMOSS / 復旦NLP / 上海創智 / MOSI·· 2026-09-06AI 評分59

OpenMOSS 團隊開源發佈 MOSS-Audio 4 款音訊理解模型

OpenMOSS/MOSS-Audio

AI 導讀

OpenMOSS 團隊開源 MOSS-Audio,推出 4B、8B 的 Instruct 和 Thinking 版本。模型支援語音、環境音及音樂理解、音訊描述、時間感知問答與複雜推理,並採用跨層特徵注入和時間標記設計。在 MMAU、MMAU-Pro、MMAR 和 MMSU 四項通用音訊理解基準中,MOSS-Audio-8B-Thinking 的平均準確率為 71.08。

來源:OpenMOSS / 復旦NLP / 上海創智 / MOSI · github.com