跳到正文
原文
Anthropic:Alignment Science Blog·· 4 天前AI 評分60

AI 的「混亂失誤」:錯位如何隨模型智能與任務複雜度變化?

The Hot Mess of AI: How Does Misalignment Scale with Model Intelligence and Task Complexity?

AI 導讀

Anthropic 研究團隊以偏差與方差分解分析前沿推理模型,發現推理或行動序列越長,錯誤中的不一致性佔比越高。在基準任務中,較智能模型在容易題目上的錯誤較一致,但最難題目上的錯誤不變或更不一致。多個樣本集成可降低不一致性,但在行動不可逆的真實智能體任務中可能難以實用。

來源:Anthropic:Alignment Science Blog · alignment.anthropic.com