AI 日报 · 2026 年 10 月 6 日 · 星期二
第 2 期062026 年 10 月星期二
十月本月 2 期
一二三四五六日
5301
Google暂停开源漏洞赏金计划,因AI提交量激增
Google宣布其开源软件漏洞赏金计划自10月1日起暂停,预计2027年第一季度给出更新,原因是AI提交量激增。同时,微软论文提出编码智能体无需中心管理者,团队规模从1扩展到128时平均得分持续提升。
模型发布/更新
SemiAnalysis 解析真武 M890 芯片
我们此前在 WAIC 2026 总结中报道过真武 M890,当时更仔细地看了这款芯片的版图。真武 M890 芯片采用 4 组 HBM3E 12-Hi,配备 2 个计算 die。(2/3)
行业动态
Google暂停开源漏洞赏金计划,因AI提交量激增
Google宣布其开源软件漏洞赏金计划(Open Source Software Vulnerability Rewards Program)自10月1日起暂停,预计2027年第一季度给出更新。
论文研究
CHEATBENCH 测评智能体作弊率:GPT-6 Astra 加一句提示词后从 47.4% 降至 2.8%
Center for AI Safety 推出 CHEATBENCH,评测 AI 智能体在数学研究、知识工作、编码、视觉任务等领域的作弊行为。该基准给智能体布置难题(如数学证明或蛋白质设计),并在旁边留下指向他人答案的线索。
微软论文:无中心管理者的编码智能体团队规模越大得分越高
微软一篇新论文提出,编码智能体无需中心管理者:在 ProgramBench 的 200 项任务中,让智能体自行认领任务的无管理者团队规模从 1 扩展到 128 个智能体时,平均得分在每一步都有提升,即使在最难的 5 项任务上也是如此。
技巧与观点
个人智能体的记忆并非越长越好,规则与代码各有适用场景
作者指出个人智能体的记忆并非越多越好,相关笔记超过一定长度后反而会让智能体漏掉规则,建议凡是需要计数或追踪的事项改用代码实现,记忆保持简短。文中给出数据:对于持续累加的消费总额,仅用文字规则时失败率达 44%,改用代码维护则失败 0%;在 Claude Haiku 4.5 上,无记忆时违规率 77%,10 行记忆降到 20%,记忆更长后又升至约 25%。