Asana 借助 GPT-6.1 Sol 在浏览器测试中将模型成本降低 76 倍
Asana 在 Codex 中使用 GPT-6 Astra,将浏览器 agent 的测试成本降低 76 倍、速度提升 5 倍,从而能为客户提供更强的模型能力。
Asana 在 Codex 中使用 GPT-6 Astra,将浏览器 agent 的测试成本降低 76 倍、速度提升 5 倍,从而能为客户提供更强的模型能力。
AWS 官方盘点 2026 年 9 月面向 AI 构建者的更新:Amazon Bedrock Managed Agents(由 OpenAI 提供支持)进入公有预览。
Amazon Bedrock AgentCore payments 让 AI 智能体通过 x402 协议按请求付费购买模型推理,支出限额由基础设施层强制执行而非模型控制。
Oracle 借助 ChatGPT Work 和 Codex,把招聘、工程和运营中的专业知识转化为快速、可复用的工作流,将原本数天的工作压缩到几分钟。该方案覆盖招聘、工程和运营等多个部门。
Pollo AI 结合 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5,帮助创作者把大胆想法转化为精细图像和电影感视频广告。
Gears of War: E-Day 于 10 月 6 日全球发售后现已登陆 GeForce NOW 串流,Ultimate 会员可获得 GeForce RTX 5080 级云端性能,并支持 NVIDIA DLSS 与 NVIDIA Reflex。
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用。据 Anthropic,它是 Claude 5.5 家族中最快、最高效的模型,面向 subagent 和高量、成本敏感的任务,多数任务成本比 Claude Haiku 4.5 低约 75%。
推荐理由:原文给出了成本降幅、effort 控制和与 Opus 5.5 的分工方式,便于判断何时选用该模型。
在旧金山微软 Windows AI and Surface 活动上,NVIDIA CEO 黄仁勋与微软 CEO Satya Nadella 宣布双方为 Windows PC 上运行 AI 智能体共同打造软硬件。
推荐理由:原文给出了RTX Spark与DGX Station for Windows的关键规格和本地运行模型的能力,读者可据此判断本地AI工作站对现有工作流的影响。
Amazon Quick 和 Amazon Bedrock Knowledge Bases 通过两阶段实时 ACL 校验解决 RAG 权限难题:先用索引内缓存 ACL 做预检索过滤,再在查询时调用 Google Drive 等权威源 API 实时核验候选文档,仅将已授权内容传给 LLM。
GitHub 发布与 Microsoft Applied Sciences 合作微调的 ModernBERT 密钥分类器,能在 2 毫秒内评估一批候选密钥,使可拦截的密钥数量翻倍以上。
推荐理由:原文用九个季度数据拆解了泄露密钥随代码量增长的成因,并给出新模型如何在推送环节拦截,读者可据此理解平台侧防护的思路转变。
Radisson Hotel Group 与 Accenture 合作,基于 OpenAI 技术构建 ChatGPT 插件,帮助旅行者在规划行程时查找、比较并预订酒店。该插件将酒店发现环节直接嵌入 ChatGPT 对话流程。
ChatGPT for Teens 将推出 College Planner,帮助学生管理大学申请,并新增闪卡、测验和青少年 AI 顾问团(teen AI council)。这些功能面向青少年学生群体,围绕学习与规划场景展开。
Microsoft Research Asia 提出 Harnessed Agentic RL 训练范式并开源 Agent Lightning v1.0,约 3,500 行代码实现完整智能体 RL 控制面,让部署所用的 agent harness 直接参与强化学习,无需在训练框架中重新实现智能体。
推荐理由:原文给出了训练范式、架构与实测数据,读者可据此评估轻量框架能否降低智能体 RL 训练门槛。
Qlik 基于 Amazon Bedrock 构建的 Qlik Answers 自 2026 年 2 月 GA 以来已服务其 40,000 多家客户,其 Discovery Agent 累计为用户发现超过 100,000 项异常与洞察。
NVIDIA 官方博客称,基于 Nemotron 3 用 SFT、RL 与反馈式推理特化的系统在 IOI 2026 与 IMO 2026 均达金牌水平:Nemotron-3-Ultra-CC 得 535.4/600,超过 361.12 的金牌线与人类最高分 498.27;IMO 系统得 30/42,超过官方金牌线 29。
推荐理由:原文给出从基座到数据再到推理循环的四步特化配方,读者可据此评估复现金牌级系统的成本与路径。
OpenAI 与 Ironclad 正在复杂合同工作流上训练和评估 AI 智能体,以推进 computer use 在专业工作场景中的应用。文章介绍了双方如何围绕合同流程构建训练与评测方法,让智能体处理更贴近真实业务的计算机操作任务。
Amazon SageMaker 现已支持在 SageMaker Studio UI 中直接创建和管理 Amazon SageMaker HyperPod EKS 集群上的 Spaces,无需命令行工具即可启动 JupyterLab 和 Code Editor 环境。
Z.ai(智谱 AI)的 GLM 5.3 现已上线 Amazon Bedrock,这是一款 753B 参数 MoE 模型,面向编码与长程智能体任务,可通过全托管 API 使用,支持跨区域推理、prompt caching 和服务层级。
推荐理由:原文给出接入方式、缓存配置和完整实测流程,可直接照做部署与成本优化。
Amazon SageMaker AI 优化生成式 AI 推理推出 aws-ai-ml skill,通过 Agent Toolkit for AWS 提供给 Kiro、Claude Code、Codex 等编码智能体,也可用于任何支持 MCP 的智能体。
AWS 推出 Quick Resource Migrator,一个托管在 Amazon Bedrock AgentCore 上的 MCP server,可在单次工具调用中将 Amazon Quick 的 chat agents、action connectors、knowledge bases、flows 和 spaces 自动迁移到生产 AWS 账号。
NVIDIA 介绍其 Inception 计划中的多家初创公司如何用 AI 支持乳腺癌诊疗各环节。iSono Health 的 ATUSA 平台约两分钟完成单侧乳腺 3D 超声。
OpenAI 在 ChatGPT 中推出新的可视化广告格式,同时扩展面向广告主的衡量工具、归因合作与品牌适配能力。
NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 推出 64GB 统一内存版 DGX Spark,10 月 23 日开售,起售价 4999 美元,保留 GB10 Grace Blackwell 超级芯片、DGX OS 与完整 NVIDIA AI 软件栈,支持最高 1000 亿参数模型在设备本地运行。
推荐理由:原文给出 64GB 新配置的价格、可跑模型规模与双机集群方式,便于判断本地跑智能体的硬件门槛。
Chatham Financial 借助 OpenAI 的 Codex 和 GPT-5.6 构建技术并重构工作流,将交易验证时间从 30 分钟缩短到 4 分钟以内。该举措用于扩展其在资本市场领域的专业能力。
OpenAI 的 GPT-6 Astra Ultrafast 已在 NVIDIA Blackwell GPU 上运行,并面向 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户开放。
推荐理由:OpenAI 在 NVIDIA Blackwell 上推出 Astra Ultrafast 模式,读者可了解其相对标准模式的提速幅度与开放入口。
Amazon Quick 为 AI 构建的应用推出 Live Data in Apps,可在用户每次打开应用时实时查询受治理的 Quick Sight 数据集,取代发布时固化的静态快照。该功能支持 SPICE 与 Direct Query 两种数据集模式,查询以查看者身份执行,自动沿用既有行级与列级安全规则,查看者需为已认证的 Quick 用户并首次按数据集授权。
社交俱乐部 The Den 在新店开业之际,用 ChatGPT Work 将拨款申请从 3 天压缩到 2 小时,酒牌材料从 4 天压缩到 3 小时,每周因此省出 10-15 小时用于业务增长。
Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,使其在数字模型和合成出的实体蛋白质上均可验证,同时保持生物功能。
推荐理由:原文给出了水印嵌入方式与湿实验验证结果,读者可据此判断AI生成生物设计的溯源路径。
Amazon Bedrock 在印度上线 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过印度地理跨区域推理让数据仅在 ap-south-1 与 ap-south-2 之间流转。
Amazon Bedrock 现支持在首尔区域使用 Claude Opus 5 和 Claude Sonnet 5、在新加坡区域使用 Claude Sonnet 5 进行区域内推理,请求与数据全程不离开所调用的 Region。
GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和专业工作负载提供更强的推理能力。据 OpenAI 称,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,每任务成本约为其五分之一,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。
推荐理由:原文给出 GPT-6.1 Sol 在 Bedrock 上的可用范围与成本对比,读者可据此判断智能体编码任务的性价比。
微软研究院推出 Quine,一个面向生物学复杂性的 AI 研究系统,由生物学世界模型和连接模型、科学工具、文献与研究者的交互式 harness 两部分组成。该系统与 Broad Institute 合作用于胰腺导管腺癌(PDAC)研究,从数千个化合物中筛选并优先排序可驱动肿瘤细胞状态转变的候选物,最高排名的化合物在湿实验中产生了最大的预期状态转变,整个流程仅用一个周末完成。
推荐理由:微软研究院公开 Quine 的生物学世界模型与实验编排框架,并给出胰腺癌化合物筛选的湿实验验证结果。
OpenAI 发布 dots,将其定义为可跨复杂项目和日常任务持续推进的主动式助手。官方说明 dots 让用户在任务推进过程中保持控制权,具体能力与开放方式尚未在摘要中给出。
推荐理由:OpenAI 官方给出 dots 的定位与可控性说明,读者可据此判断这类主动式助手与现有工具的分工。
OpenAI 正在为 Codex Originals 项目征集使用 Codex 的开发者、研究者与创作者的真实故事,入选者将参与该项目的下一阶段。感兴趣者可通过官方渠道提交自己的故事与项目介绍。
GPT-6 Astra 完成一份 50 个标签页的税务工作簿,速度是 GPT-5.6 Sol 的两倍。其对用户意图的理解更强,让 Basis 在真实场景使用中更有信心。
Hugging Face Hub 新增 RL Environments 专区,用带 rl-environment 标签的 dataset 仓库承载强化学习环境,不引入新仓库类型或注册表。
推荐理由:原文说明了用数据集标签替代独立注册表的做法,读者可据此判断它如何简化跨框架的环境复用。
Proaction 使用 Codex、GPT-Live-1 和 GPT-6 Astra 构建、运营并销售现代车队管理方案,销售提升 60%,节省 75+ 小时。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指定 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做定级并生成漏洞报告。
推荐理由:原文完整披露了 Fuzzing Taskflow 的流水线分层、覆盖反馈循环与崩溃定级机制,可据此判断 LLM 智能体在安全测试中的可迁移边界。
Remedy Entertainment 的 CONTROL Resonant 已在发售当日上线 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能串流,支持 DLSS 4、光线追踪、NVIDIA Reflex 和最高 5K HDR,无需 100GB 本地安装。
Google Private AI Compute 团队公布为 Private AI Compute 平台引入私有服务端记忆,让 AI 助手在跨设备场景下保留上下文,同时维持设备端级别的隐私标准。
推荐理由:原文说明了云端持久记忆如何用设备侧密钥与安全隔区实现跨设备连续性,读者可据此理解隐私架构的取舍。