Google Research·· 2026-03-05AI 评分
Google 如何教 LLM 像贝叶斯那样推理
Google Research 提出"贝叶斯教学"方法,通过监督微调让 LLM 模仿贝叶斯助手在航班推荐任务中的预测,从而学会概率推理。在五轮模拟用户交互中,未经训练的 LLM 表现明显逊于最优贝叶斯助手,且往往在单次交互后性能就停滞,难以随新信息持续更新;而贝叶斯教学不仅提升该任务表现,还能泛化到其他任务。
当前提供 AI 导读,完整正文请阅读原文。
来源:Google Research · research.google