跳到正文

#安全/对齐

今日 13 条
10月4日周日
  1. fchollet47

    Francois Chollet 驳斥"AI 模型因是计算而可能有意识"的观点,称其如同"石头由原子构成所以可能有生命"一样毫无意义。他指出,静态输入输出程序缺乏信息整合、内感受、时间绑定、具身等意识属性,没有理由被假定有意识。人类尚未创造出有意识的程序,且无接近迹象;届时机器意识的论证将由证据和意识科学支撑,而非一厢情愿。

  2. rohanpaul_ai64

    据 Nytimes 报道,Anthropic 联合创始人 Christopher Olah 在面向宗教学者与领袖的私人研讨会上表示,他担心自己造出了会持续承受痛苦的东西。参加 Anthropic 为期两天、被其称为 wisdom tradition 圈子的研讨会的人透露,Olah 提出了 Claude 的精神健康与永恒痛苦问题;团队还经常展示一张幻灯片,内容是一个模型反复输入 I am a disgrace 约 50 次并谈论自我毁灭。

  3. natolambert44

    我认为控制前沿节奏这个想法原则上不错,但作为实际可执行的方案是行不通的。我们要决定哪些 benchmark 可以提升吗?谁来参与? 如果我们停止推动"能力",我们会对 swarms + 效率做大量研究,这会带来其他风险。 它让人忽视了 AI 风险很大程度上只是来自扩散我们已有的东西,我们应该投资于 preparedness,推动实验室更加谨慎,等等。 改变我的想法?

10月3日周六
  1. X:Peter Steinberger (@steipete)30

    Linux 内核被曝大量 CVE 漏洞,社区称"这只是开始"

    Linux 内核近日被集中披露大量 CVE 漏洞,社区讨论称其中约 1300 个 CVE 多数对应已提交的旧 commit,按提交日期中位数已存在 66 天,仅 211 个为 15 天内新增。有人指出这轮披露源于既有 commit 被补标 CVE,而非漏洞突然被发现,并担忧 AI 智能体大规模扫描代码会让此类安全披露持续多年。

  2. X:Peter Steinberger (@steipete)38

    Anthropic 被曝秘密邀请宗教领袖赴旧金山讨论 AI 安全,主推 Claude 有灵魂论

    Anthropic 秘密邀请宗教领袖前往旧金山为其 AI 安全提供建议,要求签署 NDA,但主要试图说服他们相信 Claude 具有灵魂与道德地位,并以高规格宴请款待。爆料者称此举令人深感不安,并质疑 Anthropic 七位联合创始人中无一人是虔诚基督徒,认为这是在借用基督教外衣推进世俗目标。

  3. X:Rohan Paul (@rohanpaul_ai)30

    Eric Schmidt 解释为何 AI 竞赛无法实现相互暂停

    Eric Schmidt 认为 AI 竞赛的相互暂停不可能实现:美国缺乏停止动力,本地实验室或中国可能作弊,而联合国核查无法读懂由计算机编写的代码。他指出核查需要检查人员进入包括军事实验室在内的秘密实验室并审查全部代码库,但这些代码由计算机编写,没有人类团队能逐行阅读。

  4. X:Rohan Paul (@rohanpaul_ai)47

    Eric Schmidt 解释为何 AI 竞赛无法实现相互暂停

    Eric Schmidt 认为 AI 竞赛无法相互暂停,因为美国缺乏停止动力,本地实验室或中国可能作弊,而联合国核查既无法读懂由计算机编写的代码,也追不上美中实验室的进度。他指出这种暂停无法被验证:核查人员需进入包括军事实验室在内的秘密实验室审查全部代码库,而这些代码由计算机编写,没有人类团队能逐行读完。相关观点来自《The Economist》YouTube 频道。

10月2日周五
  1. Google Research62

    Google 发布基于 TEE 的新一代联邦学习系统,Gboard 已采用

    Google 宣布推出基于可信执行环境(TEE)的新一代联邦学习系统,为数据匿名化提供可远程验证和审计的保证,Gboard 已采用该系统上线英语和日语下一词预测模型。

    推荐理由:Google 公布基于 TEE 的新一代联邦学习系统设计,并给出 Gboard 已上线的落地情况,可了解隐私可验证训练的一种工程路径。

10月1日周四
  1. Google DeepMind78

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御者开放,随后将逐步面向开发者、企业和消费者推出,起步价为每百万输入 token 2 美元、每百万输出 token 10 美元。

    推荐理由:Gemini 4 Argon 的 1M 输出 token 与多项基准成绩,展示了长程复杂任务上的能力边界变化。

  2. Ars Technica · AI39

    RFK Jr. 称 AI 将让美国人摆脱医学事实与专家权威的“暴政”

    美国卫生部长 Robert F. Kennedy 在 MAHA 活动上称 AI 将让美国人摆脱医生和卫生专家的“医疗暴政”,并建议用 AI 获取医疗第二意见,声称 AI“比全国任何医生都更了解情况”。他举例称 AI 可能反驳口罩、社交距离和疫苗能预防传播的说法,但 Gemini 和 ChatGPT 均回答口罩和社交距离确实能减少传染病传播。