跳到正文
原文
字節 Seed:Research Feed·· 5 小時前AI 評分75

字節 Seed 發佈 SeedRealtime 原生音訊及影片全雙工大模型,邁向全模態自然互動

SeedRealtime 音视频全双工大模型发布:走向全模态自然交互

AI 導讀

字節 Seed 正式推出原生音訊及影片全雙工大模型 SeedRealtime,透過統一架構在連續多模態資訊流中即時互動。SeedRealtime 已在豆包 App 全量上線;端到端人工評測顯示,與級聯模型相比,其音訊及影片對話節奏問題減少一半,單次對話順暢、完整交流的機率亦有明顯提升。項目主頁:https://seed.bytedance.com/seedrealtime

來源:字節 Seed:Research Feed · seed.bytedance.com