Anthropic:Alignment Science Blog·· 4 天前AI 評分61
Anthropic 研究用 Influence Functions 追溯模型輸出如何受訓練資料影響
Tracing Model Outputs to the Training Data
AI 導讀
Anthropic 研究展示如何將 influence functions 擴展至最多 52 billion parameters 的大型語言模型,以追蹤哪些訓練序列影響模型輸出。
來源:Anthropic:Alignment Science Blog · anthropic.com