Google DeepMind·2026-03-26 00:46· 2026-03-26AI 评分58Google DeepMind 发布 AI 有害操纵评测工具包与九项研究结果AI 导读Google DeepMind 发布关于 AI 有害操纵的新研究,称其构建了首个经实证验证的工具包,用于在真实场景中测量这类 AI 操纵,并公开了开展同类人类参与者研究所需的全部材料。正文阅读原文 当前提供 AI 导读,完整正文请阅读原文。来源:Google DeepMind · deepmind.google#论文/研究#安全/对齐#Agent#Google