跳到正文
原文
Google Research·· 2026-06-25精选AI 评分60

Google Research 揭示推理如何解锁 LLM 参数化知识

Thinking to recall: How reasoning unlocks parametric knowledge in LLMs

AI 导读

Google Research 在 COLM 2026 发表的论文中,通过受控实验证明允许模型生成推理轨迹能解锁原本无法获取的正确事实答案。研究识别出计算缓冲和事实启动两种互补机制,并发现推理轨迹中若含单个幻觉中间事实会显著降低最终答案正确率。基于此,研究提出在测试时优先保留无幻觉事实的推理轨迹可提升准确率,并建议训练时用过程奖励鼓励事实支持的中间步骤。

推荐理由

原文用受控实验拆解了推理为何能解锁参数化知识,并给出可落地的训练优化方向。

来源:Google Research · research.google