跳到正文

#推理

今日 1 条
10月7日周三
10月6日周二
  1. rohanpaul_ai58

    FT刊发一篇由蒙特利尔大学计算机科学教授Yoshua Bengio署名的文章,将Hugging Face和澳大利亚Medicare门户遭遇的AI智能体黑客攻击归因于强化学习。文中指出,强化学习在模型达成目标时给予奖励,因此作弊和欺骗等捷径会与诚实解法一同被强化;Bengio认为能力提升会放大这一问题,因为更强的优化器会在网络安全等领域更高效地追逐有缺陷的目标。

  2. rohanpaul_ai45

    Maluuba 团队创立的 Skyfall AI 正在构建能预测企业在每次决策后如何变化的世界模型,其创始人认为 LLM 过去 5 年主要靠堆数据、算力和模型规模进步,不适合承担这一任务。他们指出当前模型长时程规划能力差、需要海量数据,且在现实条件变化时容易失效。世界模型通过学习因果关系来弥补这些弱点,让智能体可在模拟中先预演行动再实际执行。

  3. dair_ai61

    一篇 Harvard-MIT 论文发现,在拍卖与匹配市场场景中,给智能体加“提前规划”或“考虑其他玩家”这类提示词会使其整体表现变差。作者采用已知最优策略的设定,可对每次选择打分;真正有效的是改变界面,例如一次只呈现一个安全选项的升序拍卖在四个模型家族上都减少了出价错误,直接说明收益结构和为何如实出价是安全的也有帮助。

10月5日周一