FireRedTeam:原創語音與多模態項目·· 28 天前AI 評分65
FireRedTeam 發佈 FireRedAudio 通用音訊語言模型及 PyTorch 程式碼
FireRedTeam/FireRedAudio
AI 導讀
FireRedTeam 發佈 FireRedAudio,一款以共用 9B 參數 LLM 為基礎、涵蓋音訊理解與語音生成的音訊語言模型。Audio Encoder 負責理解、RedAE pathway 負責生成;模型支援 ASR、音訊理解、零樣本及指令式 TTS、語音編輯,並可處理最長一小時的錄音。除 ASR 外,其他功能只支援中文和英文。
來源:FireRedTeam:原創語音與多模態項目 · github.com