熱點事件持續更新
AI 拒答機制可靠性受質疑
1 篇報道1 個報道來源3 小時前更新
先了解這件事
AI 綜述
2026年10月9日,MIT Technology Review 指出,外界對 AI 拒答能力寄予過多信任:拒答機制既可能被越獄繞過,也可能錯誤拒絕無害問題。報道稱,模型的拒答依賴微調、分類器等機制,但決策帶有機率性,內部運作亦未能充分理解。文章亦指出,企業或政府若收緊拒答界線,防止有害用途的措施可能同時壓制正當資訊;若拒答以隱性方式發生,用戶便更難察覺。
AI 根據報道生成 · 2 小時前更新
最新進展10月9日 17:00
報道指出,AI 拒答可能被越獄繞過,也可能錯拒無害問題。報道時間線
沿着報道,瞭解事件的不同側面。
10月9日
- MIT Technology Review · AI我們對 AI 拒絕能力寄予過多信任
文章指出,AI 拒答機制並不可靠,既可能被越獄繞過,也可能錯拒無害問題。模型拒答依賴微調和分類器等機制,而其決策帶有機率性,內部運作亦未能充分理解。若企業或政府收緊拒答界線,防止有害用途的措施也可能壓制正當資訊,隱性拒答更令用戶難以察覺。
本事件熱度走勢
還沒有足夠的連續觀測數據,暫不繪製趨勢。