跳到正文
原文
Redwood Research:Blog· Alex Mallen·· 4 天前AI 評分53

能力研究也會擴展 AI 安全與有用性的帕累托前沿

Capabilities research expands the safety-usefulness Pareto frontier too

AI 導讀

能力研究也會擴展 AI 安全與有用性的帕累托前沿,但擴展選項不代表開發者會選擇更安全的方案。安全研究通常降低提高安全所需付出的有用性代價,能力研究則通常增加以安全換取有用性的誘因。他認為,若開發者已全面自動化 AI 研發,並願意犧牲領先優勢換取安全,某些能力研究或可成為有效的安全乾預;但目前開發者仍處於激烈競爭中。

來源:Redwood Research:Blog · blog.redwoodresearch.org