MIT News· Adam Zewe | MIT News·· 2026-07-13AI 評分66
MIT 研究團隊提出無須生成圖像即可檢測模型 CSAM 生成能力的方法
New method aims to keep kids safe from illegal AI-generated content
AI 導讀
MIT 研究團隊與 Thorn 合作提出一種模型審核方法,可在不生成圖像的情況下判斷模型是否經微調以生成 CSAM。方法以 Gaussian probing 分析 LoRA adaptor 對模型內部計算的修改;在三類模型變體的測試中,識別經調整以生成 CSAM 的模型準確率為 100%。託管平台可用這項方法標記不安全模型,並將其移除或阻止上傳。
來源:MIT News · news.mit.edu