跳到正文
原文
rohanpaul_ai· @rohanpaul_ai · X·· 2 天前AI 评分56

Meta 首席 AI 官 Alexandr Wang:对齐问题尚无解法,路径是可扩展监督

AI 导读

Meta 首席 AI 官 Alexandr Wang 表示,对齐(alignment)是 AI 领域最开放的科学问题之一,目前没有人知道确切的解决方法,但有几个思路。

正文 · AI 翻译

Alexandr Wang(@alexandr_wang,Meta首席AI官):还没有人知道如何解决对齐问题。

“我认为,这是AI领域科学上最开放的问题之一。我认为没有人确切知道解决这个问题的方法,但有一些思路。”

他的解决方案是“可扩展监督”:

“随着AI变得越来越聪明,我们用另一组AI来观察它们在做什么,并对它们进行约束。”

监视AI必须随着它们所监视的模型一同进步,因此各实验室也需要构建“越来越聪明的监管智能体”。

Meta的Muse已经在使用这一方法的某个版本,由一个独立的哨兵智能体检查主智能体的行为。

----

完整视频见“Cleo Abram”YouTube频道(链接在评论区)

来源:rohanpaul_ai · x.com