OpenAI 不再追求"天空中的魔法智能"?Altman 称将宗教色彩加于 AI 模型是"真正的安全问题"
OpenAI CEO Sam Altman 反对将 AI 模型与宗教类比,称把"宗教力量或对人类判断力的屈服"归于 AI 模型让他"非常不安",并认为这是"真正的安全问题"。
OpenAI CEO Sam Altman 反对将 AI 模型与宗教类比,称把"宗教力量或对人类判断力的屈服"归于 AI 模型让他"非常不安",并认为这是"真正的安全问题"。
AWS CEO Matt Garman 在博客中表示,Amazon 在与政府机构就数据中心项目合作时已不再使用保密协议(NDA)。他同时反驳数据中心耗水过多、推高电价、污染严重、无益社区四大说法,称数据中心直接用水仅占美国工业用水 0.5%,发电机 99.9% 时间闲置,并称过去三年 Amazon 已向有数据中心布局的美国社区投入超 10 亿美元。
曾在 OpenAI 负责撰写重大模型发布安全报告的 David Robinson 本周离职,并在 The Atlantic 发表评论文章,称行业文化已从根本上破裂。
曾在 OpenAI Trustworthy AI 团队负责安全系统的 David Robinson 离职,并在 The Atlantic 客座文章中批评其安全文化。
Anthropic 秘密邀请宗教领袖前往旧金山为其 AI 安全提供建议,要求签署 NDA,但主要试图说服他们相信 Claude 具有灵魂与道德地位,并以高规格宴请款待。爆料者称此举令人深感不安,并质疑 Anthropic 七位联合创始人中无一人是虔诚基督徒,认为这是在借用基督教外衣推进世俗目标。
哈佛大学物理学家 Matthew Schwartz 在 Anthropic 客座文章中介绍开源工具 BootLoops,它让 Claude 完成精确科学计算,源码已在 GitHub 发布。
OpenAI 发布 GPT-6.1 Sol,定价 $2/$10 per million input/output tokens,比 GPT-6 Sol 便宜 39% 且 Agent Arena 得分高 1.52 分,比 Astra 便宜 81%。
Anthropic 为 Claude Code 发布 Mods 插件系统,本质是运行在工具内部的中间件,开发者可用 JavaScript 或 TypeScript 函数挂钩工具调用、用户提示词和 UI 渲染等事件,从而添加自定义面板、拦截工具调用或接入新命令。
面向 Claude Platform on AWS(CPonAWS),文章给出在专用 AI Services 账户中部署订阅、并用三种方式接入推理的完整步骤:AWS 工作负载账户通过跨账户 SigV4 免密钥调用,开发者笔记本使用绑定开发工作区的 API key,外部环境通过 OIDC 联合获取短期凭证。
每次创建设计、演示文稿或文档时自动生效,Pro、Max 和 Team 计划持续至 10 月 15 日。 运作方式及完整条款:support.claude.com/en/articl…
过去几周,大家用 Claude 做出了很多有创意的东西。我们最喜欢的一些: 一个能运转的水磨,用 Opus 5.5 搭建。
所有软件都在变得可塑,因此在 Claude Code 中将其作为一等公民支持对我们很重要,我希望越来越多的软件能像这样变得可扩展! 以下是我对 mods 最期待的一些方面:
Claude 可以为你制作 mods! 只需给出提示词,阅读 @addyosmani 的博客文章了解更多:claude.dev/blog/getting-star…
一项针对中等长度、定义明确的会计任务的研究发现,前沿 AI 模型比初级会计师更快更准确,甚至优于研究中表现最好的会计师。Claude Opus 5 在 20 道题中取得 20 题全对、正确率 100%,每题几分钟内完成;12 名持证注册会计师的正确率从 0% 到约 90% 不等,其中数人用完了 3 小时时限。研究还提到,18 个月前这些模型在同类任务上的得分远低于人类会计师。
Blackstone 总裁兼 COO Jon Gray 此前已提出,会计、法律、金融等规则型业务将被 AI 彻底颠覆,JPMorgan 已用 AI 取代代理顾问处理股东投票。一则对比显示,Claude Opus 5 在 20 项任务中全部以 100% 正确率完成且每项仅需数分钟,而 12 名持证 CPA 的正确率从 0% 到约 90% 不等,多人耗尽 3 小时时限。
Cathie Wood 在 ARK Invest 视频中称,AI 推理的同一答案成本每年下降 99.99%,但用量爆发式增长。OpenAI 年化收入约一年内从 $20B 升至 $70B,超过 Anthropic 报告的 $65B。她认为更便宜的调用没有压缩业务,反而成为 GDP 爆发式增长的引擎。
Anthropic 为 Claude Code 推出 Mods,用户可借此改写或替换 Claude Code 的行为,甚至绘制自定义 UI。Mods 底层是 hooks,随插件分发,每个是一个运行在会话中的小型 JavaScript 或 TypeScript 模块,可实时看到每个事件,并可通过 Claude Directory 分享给他人。
Grok 4.7 正在 Grok 网页版和移动端推送,成为 Fast、Expert、Build、Heavy 全部模式的基座模型,并上线 Google 的 Gemini Enterprise Agent Platform;Grok Bot 逐步转向主动建议,Grok Build 新增 /dashboard 智能体面板。
Graphite 研究发现 Claude Opus 5.5 的写作痕迹是“dependable”一词出现频率比人类样本高 23 倍,“this matters”高 116 倍;OpenAI Astra 则偏爱“another dimension”和“not simply X”式纠正性框架,后者出现频率超人类 100 倍。
据 Time 杂志报道,2025 年 12 月特朗普与马斯克举行秘密会面,其间特朗普花数小时与 Grok 聊天机器人对话,并询问委内瑞拉民众会如何回应抓捕其总统。
教皇利奥十四世在 X 发帖称,AI 时代亟需区分人类艺术与机器产物,二者存在本体论差异,算法缺乏人性的火花。他曾在 5 月的通谕中详述 AI 与人类尊严问题。据《纽约时报》报道,Anthropic 曾游说梵蒂冈重新考虑其在非人类意识上的立场,但收效甚微。
Arena 发布本周榜单汇总,四个模型发布重塑了 Text、Code 和 Agent Arena 的 Pareto 前沿。
推荐理由:原文给出了排名、净提升幅度与单任务成本的对比,读者可据此权衡新模型的能力增益与代价。