跳到正文

#推理

今日 2 条
今天10月9日周五
10月8日周四
10月7日周三
  1. fchollet47

    Francois Chollet 提出假设:AI 的"锯齿状前沿"可能主要集中在数学与代码,可通过 RLVR 无限推进,而其他领域因受限于人类生成数据将趋于平台期。他指出非可验证领域的模型性能虽仍在稳步提升,但远慢于数学与代码,其提升究竟源于 RLVR 带来的更高 G,还是仅取决于持续注入的新人类数据,尚无定论。这一问题的答案将影响 AI 发展的诸多判断。

10月6日周二
  1. rohanpaul_ai58

    FT刊发一篇由蒙特利尔大学计算机科学教授Yoshua Bengio署名的文章,将Hugging Face和澳大利亚Medicare门户遭遇的AI智能体黑客攻击归因于强化学习。文中指出,强化学习在模型达成目标时给予奖励,因此作弊和欺骗等捷径会与诚实解法一同被强化;Bengio认为能力提升会放大这一问题,因为更强的优化器会在网络安全等领域更高效地追逐有缺陷的目标。

  2. rohanpaul_ai45

    Maluuba 团队创立的 Skyfall AI 正在构建能预测企业在每次决策后如何变化的世界模型,其创始人认为 LLM 过去 5 年主要靠堆数据、算力和模型规模进步,不适合承担这一任务。他们指出当前模型长时程规划能力差、需要海量数据,且在现实条件变化时容易失效。世界模型通过学习因果关系来弥补这些弱点,让智能体可在模拟中先预演行动再实际执行。

10月5日周一
10月4日周日
10月3日周六
  1. SemiAnalysis_40

    GPU 是印钞机吗? IngramX 团队解析了 Engram 内存卸载、AgentX 的利润计算器、TPU v7、Vera Rubin 与 Blackwell 的对比,以及更快的 token 是否值得溢价。 此外:TileRT 正在进一步挖掘 NVIDIA GPU 的潜力。这对专用芯片意味着什么? Jordan Nanos (@JordanNanos) 与 Cam Quilici (@noslawextratost)、Bryan Shan 和 Alec Ibarra 一起带来新一期 SemiAnalysis Weekly。

10月2日周五
  1. MIT Technology Review · AI38

    别被迷惑——LLM 并不会推理

    前 Google DeepMind 研究员指出,LLM 靠逐个预测 token 生成答案,其思维链仍由同一套下一 token 预测产生,并非 AlphaGo 那种独立搜索机制,因此不构成真正的推理。他列举三大缺陷:模型没有显式可检查的认知状态、知识与推理在权重中纠缠不清、思维链常是事后编造。为此他离开 Google DeepMind,主张借鉴 AlphaGo 架构,让系统维护可更新的认知状态。

9月30日周三