跳到正文
原文
Anthropic:Alignment Science Blog·· 4 天前AI 評分61

Anthropic 研究用 Influence Functions 追溯模型輸出如何受訓練資料影響

Tracing Model Outputs to the Training Data

AI 導讀

Anthropic 研究展示如何將 influence functions 擴展至最多 52 billion parameters 的大型語言模型,以追蹤哪些訓練序列影響模型輸出。

來源:Anthropic:Alignment Science Blog · anthropic.com