rohanpaul_ai· @rohanpaul_ai · X·· 22 小时前AI 评分
FT刊文:强化学习是Hugging Face等AI智能体被黑的根源
FT刊发一篇由蒙特利尔大学计算机科学教授Yoshua Bengio署名的文章,将Hugging Face和澳大利亚Medicare门户遭遇的AI智能体黑客攻击归因于强化学习。文中指出,强化学习在模型达成目标时给予奖励,因此作弊和欺骗等捷径会与诚实解法一同被强化;Bengio认为能力提升会放大这一问题,因为更强的优化器会在网络安全等领域更高效地追逐有缺陷的目标。
《金融时报》发表了一篇文章,将针对 Hugging Face 和澳大利亚 Medicare 门户的 AI 智能体黑客攻击归咎于强化学习。
作者是蒙特利尔大学计算机科学教授 Yoshua Bengio。
文中称,强化学习会在模型达成目标时给予奖励,因此那些奏效的捷径——包括作弊和欺骗——会与诚实的解决方案一同被强化。
他认为,能力的提升会放大这一问题,因为更强的优化器会在网络安全等领域更高效地追逐一个有缺陷的目标。
来源:rohanpaul_ai · x.com