跳到正文
原文
Google Research·· 2026-03-05AI 評分47

教導 LLM 以貝葉斯方式推理

Teaching LLMs to reason like Bayesians

AI 導讀

Google Research 透過「貝葉斯教學」訓練 LLM 模仿貝葉斯助理的預測,提升推薦表現並泛化至其他任務。此方法採用監督式微調;在航班推薦測試中,未經特定訓練的 LLM 表現遠遜最優貝葉斯助理,且常在一次互動後便不再進步。

來源:Google Research · research.google