跳到正文
原文
Anthropic:Alignment Science Blog·· 4 天前AI 評分52

GRAM 模組化預訓練透過可切換模組控制語言模型的能力存取

Modular Pretraining Enables Access Control

AI 導讀

AE Studio 與 Anthropic 合作的研究團隊提出 Gradient-Routed Auxiliary Modules(GRAM),以可切換的輔助模組隔離語言模型中的特定雙重用途能力。

來源:Anthropic:Alignment Science Blog · alignment.anthropic.com