跳到正文
原文
Hugging Face Blog·· 2026-08-21AI 評分54

研究測量語音辨識模型的基準優化現象

Measuring benchmark optimization in speech recognition

AI 導讀

Hugging Face 的研究提出三項測試衡量語音辨識中的基準優化,並評估 11 個常用開源 ASR 模型,發現多個模型會重現與音訊不符的基準文本。研究在所分析的 VoxPopuli 測試片段中標記出 40% 的潛在參考文本錯誤,涉及約 3% 的參考詞;呈現基準優化行為的模型在相關測試中有 18–30% 的情況會重現錯誤參考文本。

來源:Hugging Face Blog · huggingface.co