Chollet质疑RLVR能否推动通用智能
先了解这件事
AI 综述
2026年10月7日,Francois Chollet 在 X 上提出假设:AI 的“锯齿状前沿”可能主要集中在数学与代码领域,可通过 RLVR(可验证奖励的强化学习)无限推进;而其他领域受限于人类生成数据,性能将趋于平台期。他指出,非可验证领域的模型性能虽仍在稳步提升,但速度远慢于数学与代码,其提升究竟源于 RLVR 带来的更高通用智能(G),还是仅取决于持续注入的新人类数据,目前尚无定论。Chollet 认为,这一问题的答案将影响对 AI 发展路径的诸多判断。
报道时间线
10月7日
- Chollet:RLVR 或只推高数学与代码能力
Francois Chollet 提出假设:AI 的"锯齿状前沿"可能主要集中在数学与代码,可通过 RLVR 无限推进,而其他领域因受限于人类生成数据将趋于平台期。他指出非可验证领域的模型性能虽仍在稳步提升,但远慢于数学与代码,其提升究竟源于 RLVR 带来的更高 G,还是仅取决于持续注入的新人类数据,尚无定论。这一问题的答案将影响 AI 发展的诸多判断。