OpenAI 推出 Ultrafast 速度档与 Pro 500 订阅,GPT-6 Astra 已可用
OpenAI 推出 Ultrafast 速度档,在 Codex 中 token 生成最高快 8 倍(300 tokens per second),在 API 中最高快 6 倍。
推荐理由:OpenAI 公布 Ultrafast 速度档与 Pro 500 订阅的具体倍率和 token 速度,读者可据此判断日常编码与 API 调用的成本变化。
OpenAI 推出 Ultrafast 速度档,在 Codex 中 token 生成最高快 8 倍(300 tokens per second),在 API 中最高快 6 倍。
推荐理由:OpenAI 公布 Ultrafast 速度档与 Pro 500 订阅的具体倍率和 token 速度,读者可据此判断日常编码与 API 调用的成本变化。
OpenAI 推出 Ultrafast 高级速度档,在 Codex 中 token 生成最高提速 8 倍(300 tokens per second),在 API 中最高提速 6 倍。
推荐理由:OpenAI 公布 Ultrafast 速度档与 Pro 500 新订阅档,读者可据此比较各档位的速度与用量差异。
Noam Brown 称周末试用了 OpenAI 的 dots,它找出并帮他省下约 500 美元/年的循环扣费。他认为最亮眼的部分是 dots 能接入客服,代替他完成整段短信对话。OpenAI 介绍 dots 由 GPT-6 Astra 驱动,是常驻型智能体。
OpenAI Dots 与 Higgsfield 联合推出常驻创意团队,由 GPT-6.1 Sol 驱动,用户离开时仍持续工作。用户可通过短信、电话或邮件查看进度,并随时暂停任务。
GPT-6.1 Sol 现已在 Devin 中可用。在 FrontierCode 1.1 上,GPT-6.1 Sol 得分 60.4%,与 GPT-6 Sol 的 60.7% 基本持平,但成本大幅降低:中等推理强度下每任务 0.31 美元,比 GPT-6 Sol 最高强度便宜 81%。
Cognition 宣布 GPT-6.1 Sol 已在 Devin 中可用。在 FrontierCode 1.1 上,GPT-6.1 Sol 得分 60.4%,与 GPT-6 Sol 的 60.7% 基本持平,但中等推理强度下每任务成本 0.31 美元,比 GPT-6 Sol 最高强度便宜 81%。
Cognition 宣布 GPT-6.1 Sol 已在 Devin 上线。在 FrontierCode 1.1 上,GPT-6.1 Sol 得分 60.4%,与 GPT-6 Sol 的 60.7% 基本持平,但成本大幅降低:中等推理强度下每任务 0.31 美元,比 GPT-6 Sol 最高强度便宜 81%。
OpenAI 宣布 Codex Security Cloud 迎来重大升级,默认通过 Daybreak Blue 获得具备网络安全能力的模型。该功能可扫描整个 GitHub 仓库、持续审查新提交、调查并去重发现的问题,并准备好待审阅的修复方案,即使笔记本关闭也能运行。它已作为插件在 Codex 桌面端和网页端提供。
推荐理由:Codex Security Cloud 升级后默认接入 Daybreak Blue 模型,可扫描整个 GitHub 仓库并持续审查新提交,读者可据此判断代码安全流程的变化。
ChatGPT 推出 Space,作为团队与 AI 共同创建和协作的新空间,其中可处理 pages 这类带图表、图片、清单和仪表盘的交互式文档。ChatGPT 能根据任务或对话上下文自动生成页面,团队成员可直接编辑,也可 @ChatGPT、Codex 或自己的 dot 处理待办并让页面从已连接数据源保持更新。
OpenAI 发布 GPT-6.1 Sol,今日起向 ChatGPT Work 和 Codex 的 Plus、Pro、Business、Enterprise 和 Edu 用户开放。
推荐理由:原文给出 GPT-6.1 Sol 的定价与缓存输入成本,读者可据此比较它与 GPT-6 Sol、GPT-6 Astra 的性价比。
OpenAI 发布 GPT-6.1 Sol,称其以 GPT-6 Astra 五分之一的成本提供接近 Astra 的智能水平,是当前同性能下最具成本效率的模型。缓存输入价格为每百万 token 0.10 美元,比标准输入价格低 95%,比 GPT-6 Sol 的缓存输入价格低 50%。
推荐理由:OpenAI 官方给出 GPT-6.1 Sol 的定价与缓存折扣,并说明它在编码、computer use 与对齐评测上的位置,便于判断成本与能力取舍。
OpenAI 发布 dots,由 GPT-6 Astra 驱动,是常驻后台、可自主推进任务的智能体,拥有自己的云端计算机,可通过 ChatGPT 连接 4000+ 应用。
推荐理由:OpenAI 官方给出 dots 的能力边界、接入范围与安全控制方式,可据此判断常驻智能体的落地形态。
OpenAI 发布 dots,由 GPT-6 Astra 驱动,定位为能力突出、常驻运行的智能体,用于处理各类任务。官方称其可承担各种工作,随文附有视频。
OpenAI 发文说明 dots 的安全、安全性与隐私设计,dots 是常驻运行的智能体。用户可设置边界,指定 dot 能自主做什么、何时需要先询问、以及绝不能做什么,安全机制内置于其中。用户自行选择连接哪些应用,dot 运行在独立的云计算机上,因此连接自己的应用完全可选。
一位用户称 3 周前试用了 Grok Bot,2 周前安装了 Instint,上周安装了 Muse,现在又要去试 Dots,并称个人 AI 助手之争就此开始。该帖未披露这些产品的具体功能、版本或评测数据。
OpenAI 发布 dots,这是一款具备主动能力、自带电脑的 AI 助手。该工具提供笔记功能,可用于整理工作,并已用于安排 DevDay 的差旅与会议日程。作者称其协作能力还将继续提升。
typesafe 在 Hugging Face 上线 WorkflowEvals 评测集,同时公开 GitHub 复现仓库和一份名为 evalsafe-onet 的附加数据集。配套博客以 anti-benchmaxxing 为主题,讨论基准刷分问题。
OpenAI 发布个人 AI 助手 dot,官方称"你的 dot 已准备好与你见面"。该产品目前仅面向 Pro 用户开放,美国地区暂不可用,欧洲用户也无法直接访问。部分用户反馈 dot 与 Grok bot 及 Muse 功能相似,并质疑其与 Codex 提示词的实际差异。
Perplexity 为 Perplexity Computer 推出 Automations,用于持续性的工作,可按事件触发或按计划执行。Automations 可结合用户的 memory、skills 以及 Slack、Gmail、Outlook、Linear 等已连接应用。官方博客提供了更多说明。
Perplexity 在 Perplexity Computer 中推出 Automations,用于处理持续性的工作。它可由事件触发或按计划执行,并能结合用户的 memory、skills 以及 Slack、Gmail、Outlook、Linear 等已连接应用。
Amazon Quick 的提示词工程基础指南(系列第一部分)给出跨组件通用的提示词原则与框架,包括以具体性实现清晰、用业务上下文提升相关性、以示例代替描述,以及 CRISPE 结构化提示词模板。
Amazon Quick 各组件对提示词的解析方式不同,需按组件分别设计。Quick Research 要求明确目标、受众与关注范围,并可从 Quick Index。
基于 Amazon Quick 与 Amazon Bedrock AgentCore 的合同智能平台,用 AI 智能体从合同 PDF 中提取八个关键字段,并由独立的验证智能体复核,签名识别分歧时由 Amazon Textract 作为确定性裁决。
Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体,由 Astra 驱动,ChatGPT Pro 和 Enterprise 用户当天可用,并配套推出团队协作的 ChatGPT Space。
推荐理由:现场逐条记录 OpenAI DevDay 2026 的发布节奏,可对照其智能体、模型与开发者平台布局。
一位创作者在 CueAgents 上线前 24 小时,用 Manus Studio 完成了发布视频,该视频播放量已突破 140 万。Manus Studio 调用了会议记录、Notion、Slack、Figma、代码仓库等上下文,协助完成创意、分镜和最终剪辑。Manus 2.0 现已支持视频功能。
Perplexity 公布其 Computer 智能体的安全工程方案,包括隔离微虚拟机沙箱平台 SPACE、提示注入防护 BrowseSafe 和短时代理 token 认证,SPACE 自 6 月起承载 Computer 全部生产流量。
Perplexity 公布其智能体安全工程方案,包括运行 Computer 任务的隔离沙箱平台 SPACE,自 6 月起已承载 Computer 全部生产流量。
Perplexity 分享其智能体安全工程方案,将防护措施内建到基础设施、harness 和工具中并应用于旗下产品。其 SPACE 沙箱平台自 6 月起承载 Computer 全部生产流量,每个任务运行在隔离 microVM 中;在 108 次测试中,9 个获得 root 权限的模型均未逃逸 VM。
SeatGeek 用 Serval 在 60 天内自动化了 50% 的 IT 请求,8 周内构建 132 个自动化流程,并实现零裁员。其 CEO Jack Gretz 在 CNBC Squawk Box 上表示,公司今年招聘进度已超过去年全年,IT 人员被重新部署去解决更难的问题。
ElevenLabs 宣布 Eleven v4 Turbo 已在 ElevenAgents 中可用,将 Eleven v4 的语音质量带入实时对话,中位推理延迟约 100 ms。ElevenAgents 可感知来电者情绪并相应调整,官方称这有助于在更多行业提供更具共情力的客户体验。
ElevenLabs 为庆祝 Eleven v4 Turbo 上线,在 ElevenAgents 中使用该模型的智能体即日起至 10 月 12 日每分钟仅需 3.3 美分,之后恢复标准定价。Eleven v4 Turbo 为 ElevenAgents 提供 100 ms 响应时间、通话中实时调整语气,并在 90+ 种语言中保持一致的品牌音色。
ElevenLabs 表示 Eleven v4 Turbo 在 ElevenAgents 中与自家领先的转录和轮次(turn-taking)模型协同工作。这一协同优化的技术栈让智能体响应更快、能更自然地打断,并随新模型发布持续改进。
Eleven v4 Turbo 已在 ElevenAgents 上线,将 Eleven v4 排名第一的音质带入实时对话,推理延迟中位数约 100 ms。ElevenAgents 借此可在各行业支撑更具个性化、更有共情力的客户体验。
Hugging Face 博客介绍论文 ProvenanceGuard,一个面向 MCP 智能体的生成后验证层,专门检测"跨来源混淆"——即事实在证据池中为真、却被归给错误来源。在 281 条医疗智能体真实 trace 上,专家判定 361 条 claim 中 139 条不应通过,ProvenanceGuard 拦下 138 条,并在可识别来源的 claim 上约 86% 选对来源。
DeepSeek 弹性计算团队正在大量招聘,尤其需要资深工程师。团队同时发布技术分享《DeepSeek 弹性计算 (DSec):面向大规模 Agent 训练的沙盒基础设施》,介绍面向大规模 Agent 训练的沙盒基础设施 DSec。
OpenAI 发布 DevDay 2026 回顾,汇总 20 多项发布,涉及 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。
OpenAI 发布 GPT-6.1 Sol,官方称其具备接近 Astra 的智能水平,面向编码、电脑操作和专业工作场景。该模型标准 API 输入与输出 token 价格均为 Astra 的五分之一。
推荐理由:OpenAI 公布 GPT-6.1 Sol 的定位与定价,读者可据此比较它与 Astra 在编码和电脑操作上的取舍。
百度智能云与 Finch 宣布合作推进 AI 智能体经济,将其 AI 能力与行业经验同 Finch 的平台和开发者生态结合。合作从模型集成起步,通过百度智能云 MaaS 平台千帆接入,双方还将探索 AI 智能体的新商业模式与行业应用,共建开放生态。
字节跳动豆包正在加速推进个人 AI 智能体。自 4 月起,豆包一直在低调测试代号为 Spell 的个人 AI 助手,该项目最初由手机助手团队牵头,在豆包手机发布期间保持保密。受海外个人智能体 Muse 和 Instinct 快速增长的影响,豆包正加快个人智能体落地,并计划将 Spell 集成到豆包 App 中。
腾讯推出 LightVela,把开源 Hermes Agent 托管在云端,无需写代码或配置服务器即可接入微信、QQ 和飞书。作者同时提到,Meta 的 AI 智能体 Muse 在 9 月占据美国应用榜单,13 天下载量超过 250 万次。作者认为个人 AI 助手会深度融入日常生活,只是节奏推进得很快。