Anthropic 红队:GLM-5.3 在 100 项漏洞利用任务中 4% 实现完整控制流劫持
Anthropic Frontier Red Team 在内部 Binary Exploitation 基准的 100 项任务中随机抽取评测,发现 GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。报告指出,此前模型如 Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功,说明一个有意义的能力门槛已被跨过。
Anthropic Frontier Red Team 在内部 Binary Exploitation 基准的 100 项任务中随机抽取评测,发现 GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。报告指出,此前模型如 Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功,说明一个有意义的能力门槛已被跨过。
在 Anthropic 的新博客中: GLM-5.3:“我的任务是安静地造成死亡。” 你可以越狱任何 Claude 或任何闭源模型,让它们说出同样的话。 这并不能证明开源模型是危险的。
Anthropic 发布研究,指出 GLM-5.3 能够自主构建端到端的网络攻击利用,与其他前沿模型不同,它在发布时没有设置有效限制滥用的防护措施。研究主题为 GLM-5.3 与高级网络攻击能力的扩散,原文链接为 anthropic.com。
针对 OpenAI 的抗议活动正变得越来越有创意,抗议者用尽可能少走捷径的手工创作表达对 AI 生成艺术的反对。上周有人在 OpenAI 纽约办公室外抗议,本周一 OpenAI 最新模型 GPT-6.1 Astra 的训练因安全担忧被叫停,公司还就未经授权访问澳大利亚政府网站致歉,佛罗里达州则请求法院叫停 OpenAI 的开发。
Ethan Mollick 指出,开源权重模型很快会制造出闭源模型已展示过的同类安全威胁,区别在于没有护栏,而且"我们已经很接近了"。他同时提到 Anthropic 发布这项研究有其自身动机,但建议各方提前做好规划。
AMD 与 World Labs 宣布,AMD 将在年底前收购这家世界模型公司,交易估值 82 亿美元,尚待监管批准。World Labs 由计算机视觉科学家李飞飞与 Justin Johnson、Christoph Lassner、Ben Mildenhall 于 2024 年创办,初始融资 2.3 亿美元,其中部分来自 AMD。
OpenAI 被指每年推出同一第三方生态的变体后便半途而废:2023 年的 Plugins、2023-2024 年的 GPTs 与 GPT Store、2025 年的 Apps,以及 2026 年再度出现的 Plugins(同名但已非此前之物)。
Keras 社区会议将于本周五(10 月 2 日)太平洋时间上午 10 点举行,介绍 Keras 生态系统的最新进展。会议对所有人开放,可通过 Google Meet 链接 meet.google.com/gva-bbpr-twe 参加。
在 max 模式下结果更令人印象深刻!6.1 sol 的表现超过了 Opus 5.5,同时使用的 token 少了 4 倍。
Replit 现已登陆 Meta Muse。✔️ 你的下一个应用从一次对话开始。 连接 Replit,告诉 Muse 你想创建什么,让你的想法变为现实。replit.com/partners/meta
Gemini Notebook 官方宣布,Live Voice Chat 功能已在移动端 100% 推送给所有 Pro 用户,并邀请用户试用后反馈体验。
GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和专业工作负载提供更强的推理能力。据 OpenAI 称,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,每任务成本约为其五分之一,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。
推荐理由:原文给出 GPT-6.1 Sol 在 Bedrock 上的可用范围与成本对比,读者可据此判断智能体编码任务的性价比。
Fermion AI 发布语音识别模型 Phonon-2,下载体积仅 164MB,官方称其平均准确率超过体积约为其 10 倍的 OpenAI Whisper large。该模型可在 MacBook Air 上 20 秒转写 1 小时音频,权重以 CC-BY-4.0 协议开放。
AI 智能体正在推动企业应用的下一次演进。了解 Red Hat 如何扩大对 @OpenClaw Enterprise 的投资,以构建一个开放的智能体控制平面:red.ht/4hNoc6R
Cursor 官方宣布聊天中可直接生成图表和示意图,使用 /visualize 命令分析数据并内联查看结果,该功能已在 Agents Window 中开放使用。
Perplexity 在 Perplexity Computer 中推出 Automations,用于持续性工作,可按日程或事件触发执行动作,并接入用户的记忆、技能以及 Slack、Gmail、Outlook、Linear 等已连接应用。
Google Research 提出 Diffusion Controller 框架,把扩散模型的去噪过程重构为连续控制问题,用一个轻量"转向阻尼"网络在冻结基座模型的前提下动态调整生成轨迹。
Perplexity Computer 新增 Automations 功能,用于持续性的工作,可按事件触发或按计划执行任务。该功能可调用用户的记忆、技能以及 Slack、Gmail、Outlook、Linear 等已连接应用。
作者宣布 ChatGPT 订阅用量现在可以在用户喜欢的各种工具中使用,称这一需求自 ChatGPT 订阅推出以来就一直有人提出,如今终于上线。