rohanpaul_ai· @rohanpaul_ai · X·· 1 天前AI 评分
清华、牛津、斯坦福论文:关闭 thinking 后 LLM 仍在开口推理
清华、牛津与斯坦福的新论文《Thinking Inertia: LLMs Keep Thinking When Told Not To》(arxiv.org/abs/2610.11765)发现。
清华大学、牛津大学和斯坦福大学的最新论文发现,即使关闭思考功能,大语言模型仍会大声进行推理,尤其是在开放式问题上。
在禁用思考的情况下,DeepSeek-V4-Flash 在 99.9% 的开放式回答中仍然写出了推理过程。缺少 think 标签或回复简短,并不能证明模型跳过了推理。
是非题容易直接回答,选择题介于两者之间,而开放式问题则不断将模型拉回推理状态。
在开放式任务中强制要求仅输出答案,使 5 个模型的遵从率提高到约 40%,但准确率下降了约 15 个百分点。
– arxiv. org/abs/2610.11765
标题:《思考惯性:大语言模型被要求停止思考时仍在思考》
来源:rohanpaul_ai · x.com