跳到正文
原文
Google Research·· 2026-08-12AI 评分48

Google Research:前沿 LLM 的事实性瓶颈在召回而非编码

AI 导读

Google Research 提出知识画像框架,用 WikiProfile 基准(2,150 条维基百科事实、每条配 10 道题)区分编码与召回,发现 Gemini-3-Pro 和 GPT-5 有 95–98% 的事实已编码,却仍无法直接召回 26–34%,即使开启思考也失败 11–12%。

当前提供 AI 导读,完整正文请阅读原文。

来源:Google Research · research.google