Google Research·· 2026-03-05AI 評分47
教導 LLM 以貝葉斯方式推理
Teaching LLMs to reason like Bayesians
AI 導讀
Google Research 透過「貝葉斯教學」訓練 LLM 模仿貝葉斯助理的預測,提升推薦表現並泛化至其他任務。此方法採用監督式微調;在航班推薦測試中,未經特定訓練的 LLM 表現遠遜最優貝葉斯助理,且常在一次互動後便不再進步。
來源:Google Research · research.google