Google Research·· 2026-03-05AI 评分48
Google Research:教 LLM 像贝叶斯派一样推理
Teaching LLMs to reason like Bayesians
AI 导读
Google Research 通过“Bayesian teaching”监督微调,让 LLM 模仿 Bayesian Assistant 的最优贝叶斯推理预测,弥补其默认简单启发式的不足。在简化航班推荐任务中,各系列 LLM 原本表现明显差于 Bayesian Assistant,且常在单轮交互后停滞;训练后不仅显著提升推荐任务表现,还能泛化到其他任务。
来源:Google Research · research.google