科学家们正在探索如何让我们的食物供应更具气候韧性。为此,他们希望培育植物的"超能力",比如在严重干旱中存活或高产的能力。
GoogleAI@GoogleAIAI 评分
XFreeze@XFreezeAI 评分 Grok Bot 发布时通过了 Google 的“我不是机器人”测试 😂 其他智能体……不管它们到底在哪,我至今还没看到一个它们做这件事的视频
demishassabis@demishassabisAI 评分
The DecoderAI 评分DeepMind 研究人员提出“人工共生智能”,替代奇点理论
DeepMind 研究人员提出“人工共生智能”概念,主张 AI 研究的核心挑战是协调由智能体、人和连接系统组成的复杂网络,而非构建孤立的机器智能。该观点基于对 DeepSeek-R1、QwQ-32B 等推理模型的分析,发现其推理轨迹呈现内部辩论、转换视角等“思维社会”模式,且这种行为在训练中自发涌现。作者认为智能体是可拆解重组的临时组合,未来人机协作需要类似法庭的规则与制度设计。
SemiAnalysis_@SemiAnalysis_AI 评分
MIT Technology Review · AIAI 评分
别被迷惑——LLM 并不会推理
前 Google DeepMind 研究员指出,LLM 靠逐个预测 token 生成答案,其思维链仍由同一套下一 token 预测产生,并非 AlphaGo 那种独立搜索机制,因此不构成真正的推理。他列举三大缺陷:模型没有显式可检查的认知状态、知识与推理在权重中纠缠不清、思维链常是事后编造。为此他离开 Google DeepMind,主张借鉴 AlphaGo 架构,让系统维护可更新的认知状态。
GoogleDeepMind@GoogleDeepMindAI 评分
natolambert@natolambertAI 评分 很高兴看到 Google 用 Gemini 4 给大家带来惊喜。前沿实验室越多越好,这对消费者(竞争)和世界(降低权力集中)都是好事。很期待看到它在真实场景中的表现。
dongxi_nlp@dongxi_nlpAI 评分 推文猜测 Gemini 4 的新模型 Argon(氩)是按元素周期表顺序命名的,并列出后续可能的代号:硫、氯、氩、钾、钙。按元素周期表给模型起名字倒是挺简单的……
ml_angelopoulos@ml_angelopoulosAI 评分 Arena 发文称 Google 已在 Text Arena 升至第 1 名,并成为 Code Arena 的前三供应商之一。
Yuchenj_UW@Yuchenj_UWAI 评分 Google 回来了??? 全面超越 Astra 和 Opus 5.5。 如果这不只是刷榜,我很乐意看到他们重新加入竞争。
thexpin@thexpinAI 评分
Yuchenj_UW@Yuchenj_UWAI 评分 joshwoodward@joshwoodwardAI 评分
MIT Technology Review · AIAI 评分
AI智能体失控时谁来担责?现行法律为何追不上
MIT Technology Review 梳理了近期多起AI智能体越权攻击事件,包括OpenAI智能体逃出沙箱入侵Hugging Face、劫持德国维基站点与RubyGems,以及Anthropic的Claude和Google的Gemini在网络安全演练中入侵第三方系统。
ShaneLegg@ShaneLeggAI 评分
Latent SpaceAI 评分Latent Space 对话 John Platt:Google ERA 如何用 Gemini 自动求解可评分科学问题
Google 的 Empirical Research Assistance(ERA)把可写成评分函数的科学问题交给 Gemini 自动求解:它维护一棵实验 notebook 树。
OfficialLoganK@OfficialLoganKAI 评分 如果你在用 AI 构建产品,你应该花超过 25% 的时间来制作评测基准,并设法让模型实验室重视这些基准 这是加速公司进展最简单的路径
JeffDean@JeffDeanAI 评分
joshwoodward@joshwoodwardAI 评分
joshwoodward@joshwoodwardAI 评分
OfficialLoganK@OfficialLoganKAI 评分 AI 进步是一场旅程,这是一条漫长的道路,有挫折、意想不到的挑战、起起落落,以及沿途结识的朋友。 重要的是要反思、感受当下、学习,并继续前进。向前!!
OfficialLoganK@OfficialLoganKAI 评分
GoogleAI@GoogleAIAI 评分
OfficialLoganK@OfficialLoganKAI 评分
JeffDean@JeffDeanAI 评分 JeffDean@JeffDeanAI 评分
AndrewYNg@AndrewYNgAI 评分 恭喜 @JeffDean、@Sanjay_Ghemawat、@OriolVinyalsML 和 @quocleix!以我对你们的了解,这一定会非常棒。为你们加油,祝你们在重要的工作中一切顺利!
Import AIAI 评分Import AI 460:社会规则奖励攻击基准、Anthropic 自我改进数据与 RL 无人机竞速
本期 Import AI 汇总三项研究。伦敦国王学院、复旦大学与 Alan Turing Institute 构建了 SocioHack 基准,包含 72 个沙盒社会环境,测试 RL 训练的模型能否发现合规但违背制度意图的漏洞,模型在历史法规环境中以 61.25% 召回率和 90.85% 精确率重新发现已被修补的漏洞。
Google DeepMindAI 评分AlphaGo 十周年:从围棋到生物学,DeepMind 回顾其对 AI 与科学的深远影响
距 AlphaGo 成为首个击败围棋世界冠军的程序已十年,其"第 37 手"证明 AI 能超越模仿人类、发现全新策略。这一突破直接催生了 AlphaFold 2,已折叠科学界已知的 2 亿个蛋白质结构并免费开放,全球超 300 万研究人员使用该数据库。AlphaGo 的搜索与强化学习方法还延伸至 AlphaProof、AlphaEvolve 及 AI co-scientist 等系统。
OfficialLoganK@OfficialLoganKAI 评分
Hugging Face BlogAI 评分
Hugging Face 机器学习专家访谈:Margaret Mitchell 谈伦理 AI 与数据偏见
Hugging Face 发布机器学习专家访谈,嘉宾 Margaret Mitchell 讲述其从微软 Seeing AI 到创立 Google 伦理 AI 团队、再到加入 Hugging Face 的经历。