Anthropic:Alignment Science Blog·· 4 天前AI 評分52
GRAM 模組化預訓練透過可切換模組控制語言模型的能力存取
Modular Pretraining Enables Access Control
AI 導讀
AE Studio 與 Anthropic 合作的研究團隊提出 Gradient-Routed Auxiliary Modules(GRAM),以可切換的輔助模組隔離語言模型中的特定雙重用途能力。
來源:Anthropic:Alignment Science Blog · alignment.anthropic.com