跳到正文
原文
Google Research·· 2026-03-05AI 评分48

Google Research:教 LLM 像贝叶斯派一样推理

Teaching LLMs to reason like Bayesians

AI 导读

Google Research 通过“Bayesian teaching”监督微调,让 LLM 模仿 Bayesian Assistant 的最优贝叶斯推理预测,弥补其默认简单启发式的不足。在简化航班推荐任务中,各系列 LLM 原本表现明显差于 Bayesian Assistant,且常在单轮交互后停滞;训练后不仅显著提升推荐任务表现,还能泛化到其他任务。

来源:Google Research · research.google