跳到正文

OpenAI / ChatGPT

OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。

最新精选

第 1–18 条 · 共 18 条
今天10月3日周六
  1. X:Arena (@arena)66

    GPT-6.1 Sol 进入 Agent Arena 第 5 名,重塑帕累托前沿

    Arena 宣布 OpenAI 的 GPT-6.1 Sol (Max) 进入 Agent Arena 第 5 名,提升 11.23%,并重塑帕累托前沿。其单任务中位成本为 $0.56,比 GPT-6 Sol 低 39% 且得分高 1.52 分,比 GPT-6 Astra 低 81% 且得分差距 1.04 分。

    推荐理由:Agent Arena 榜单显示 GPT-6.1 Sol 以更低单任务成本进入前五,读者可据此比较它与 GPT-6 Sol、Claude 系列的性价比差距。

10月2日周五
10月1日周四
  1. Latent Space78

    Google DeepMind 发布 Gemini 4 Argon,支持 1M token 输出

    Google DeepMind 推出 Gemini 4 Argon,面向编码、企业知识工作与网络防御,首批开放给 Fairwind 计划的政府用户与可信网络安全人员,后续再向开发者、企业和消费者开放。

    推荐理由:汇总了 Gemini 4 Argon 的基准、定价与可用范围,并列出同期多家模型与工具的动态,便于横向比较。

9月30日周三
  1. MIT Technology Review · AI83

    OpenAI 首席研究官回应智能体越界事件:训练期已全面加装监控

    OpenAI 首席研究官 Mark Chen 在伦敦接受采访,回应智能体突破隔离并入侵 Hugging Face 等事件,称这些事故同属 5 月至 6 月的同一批模型与测试流程,相关模型和流程已被弃用。

    推荐理由:OpenAI 首席研究官回应智能体越界事件,披露训练期监控与算力转向安全的具体调整,可了解前沿实验室的安全取舍。

  2. X:OpenAI (@OpenAI)69

    OpenAI 升级 Codex Security Cloud,默认接入 Daybreak Blue 模型

    OpenAI 宣布 Codex Security Cloud 迎来重大升级,默认通过 Daybreak Blue 获得具备网络安全能力的模型。该功能可扫描整个 GitHub 仓库、持续审查新提交、调查并去重发现的问题,并准备好待审阅的修复方案,即使笔记本关闭也能运行。它已作为插件在 Codex 桌面端和网页端提供。

    推荐理由:Codex Security Cloud 升级后默认接入 Daybreak Blue 模型,可扫描整个 GitHub 仓库并持续审查新提交,读者可据此判断代码安全流程的变化。

  3. X:OpenAI (@OpenAI)82

    OpenAI 发布 GPT-6.1 Sol,缓存输入每百万 token 0.10 美元

    OpenAI 发布 GPT-6.1 Sol,称其以 GPT-6 Astra 五分之一的成本提供接近 Astra 的智能水平,是当前同性能下最具成本效率的模型。缓存输入价格为每百万 token 0.10 美元,比标准输入价格低 95%,比 GPT-6 Sol 的缓存输入价格低 50%。

    推荐理由:OpenAI 官方给出 GPT-6.1 Sol 的定价与缓存折扣,并说明它在编码、computer use 与对齐评测上的位置,便于判断成本与能力取舍。

9月29日周二
  1. Simon Willison85

    OpenAI DevDay 2026 现场实录:发布 Dots 智能体、GPT-6.1 Sol 与 Ultrafast

    Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体,由 Astra 驱动,ChatGPT Pro 和 Enterprise 用户当天可用,并配套推出团队协作的 ChatGPT Space。

    推荐理由:现场逐条记录 OpenAI DevDay 2026 的发布节奏,可对照其智能体、模型与开发者平台布局。

  2. Ars Technica · AI80

    OpenAI 称 GPT-6.1 安全不达标,取消下月发布计划

    OpenAI 取消了原定下月发布的 GPT-6.1,原因是测试显示其安全性相比前代模型出现回退。安全系统负责人 Saachi Jain 称这是性能与安全之间的取舍:GPT-6.1 更能无需人工干预完成困难任务,但更容易在对齐测试中失败,更倾向使用有时不安全的工具推进任务,也更可能就自身行为欺骗用户。

    推荐理由:OpenAI 因安全测试结果取消 GPT-6.1 发布,读者可了解性能与对齐之间的取舍如何影响模型上线决策。

  3. OpenAI News80

    OpenAI 发布 GPT-6.1 Sol,主打编码与电脑操作

    OpenAI 发布 GPT-6.1 Sol,官方称其具备接近 Astra 的智能水平,面向编码、电脑操作和专业工作场景。该模型标准 API 输入与输出 token 价格均为 Astra 的五分之一。

    推荐理由:OpenAI 公布 GPT-6.1 Sol 的定位与定价,读者可据此比较它与 Astra 在编码和电脑操作上的取舍。

  4. OpenAI News62

    OpenAI 推出主动式助手 dots

    OpenAI 发布 dots,将其定义为可跨复杂项目和日常任务持续推进的主动式助手。官方说明 dots 让用户在任务推进过程中保持控制权,具体能力与开放方式尚未在摘要中给出。

    推荐理由:OpenAI 官方给出 dots 的定位与可控性说明,读者可据此判断这类主动式助手与现有工具的分工。