OpenAI 发布"Built to benefit everyone"计划:让 AGI 惠及所有人
OpenAI 公布名为"Built to benefit everyone"的计划,提出以可及性、安全与共享繁荣为核心的 AI 未来愿景,目标是确保 AGI 惠及所有人。
OpenAI 公布名为"Built to benefit everyone"的计划,提出以可及性、安全与共享繁荣为核心的 AI 未来愿景,目标是确保 AGI 惠及所有人。
Hugging Face 宣布 OpenEnv 改由委员会协调,成员包括 Meta-PyTorch、Reflection、Unsloth、Modal、Prime Intellect、Nvidia、Mercor、Fleet AI、Microsoft、Hugging Face 和 RadixArk,项目迁至 huggingface/OpenEnv。
推荐理由:OpenEnv 从单一项目转为多方共管的协议层,读者可据此了解开源智能体 RL 环境的协作方式与接入路径。
OpenAI 成立经济研究交流平台(Economic Research Exchange),用于研究 AI 对就业、生产力和经济的影响。该平台现已开放申请,面向入选的研究项目。
Google 在 Gemini Enterprise Agent Platform 上推出由 Agentic RAG 驱动的跨语料检索公开预览版,通过规划、改写、路由与充分上下文智能体迭代检索多源数据。官方称相比标准 RAG,该框架在事实性数据集上准确率最高提升 34%;在跨语料设置下从 4 个候选语料中正确路由并答对 90.1% 的问题,单语料与跨语料版本延迟差异平均在 3% 以内。
推荐理由:原文给出多智能体 RAG 的完整流程与跨语料评测数据,读者可据此判断它在多源检索场景下的可用性。
Google Research 在 Nature 发表 PHRM 研究系统,利用手机前置摄像头在面部解锁后拍摄 8 秒面部视频,通过深度学习估算心率,与心电图相比 MAPE 低于 10%,覆盖所有肤色。
推荐理由:Google 用 35 万段手机视频训练 rPPG 模型,并公开迄今最大规模数据集,读者可了解被动心率监测的可行边界。
NVIDIA 发布 Nemotron 3.5 Content Safety,基于 Gemma 3 4B IT 微调,把多模态输入、多语言覆盖、自定义企业策略执行和可审计推理统一到一次推理调用中。
推荐理由:NVIDIA 把多模态、多语言、自定义策略与可审计推理合并进一次推理调用,并公开训练数据集。
Endava 正利用 AI 智能体、ChatGPT Enterprise 和 Codex 加速软件交付并自动化工作流,在企业内部构建 AI 原生文化。
OpenAI 为 ChatGPT 引入名为 Dreaming 的新记忆系统,用于更好地记住用户偏好,并在多轮对话之间保持上下文的时效性和相关性。
推荐理由:原文给出 ChatGPT 记忆系统的新变化,读者可据此了解跨对话上下文保持方式的调整。
Hugging Face 重构官方命令行工具 hf CLI,使其同时服务人类用户和 Claude Code、Codex、Cursor 等编码智能体,通过环境变量自动识别智能体并切换输出格式。
OpenAI 发布《智能时代的生物防御》行动计划,主题为"AI 驱动的生物韧性"。该计划面向智能时代的生物安全挑战提出行动方案,具体措施与细节未在摘要信息中披露。
Google Research 在 GitHub 开源其水文建模框架,让各国气象水文机构可将 AI 洪水预报集成进自身工作流。该框架为基于 PyTorch 的 Python 包,采用 LSTM 架构,训练流程使用开源 Caravan 数据集,并已与捷克水文气象研究所(CHMI)合作验证。新版模型相较 2024 年基准版本,在有测站流域将可靠预测期延长 6 天,无测站流域延长 1 天。
OpenAI 为 GPT-Rosalind 推出新能力,面向生命科学研究,增强生物推理、药物化学专长、基因组分析与实验工作流能力。
推荐理由:OpenAI 公布 GPT-Rosalind 在生物推理、药物化学与基因组分析上的能力扩展,读者可据此了解该模型在生命科学场景的定位。
DharmaOCR 团队用 DPO 作为 SFT 之后的第二阶段训练,在巴西葡萄牙语结构化 OCR 任务上把文本退化率平均降低 59.4%,最佳案例降低 87.6%(Nanonets-OCR2–3B 从 1.61% 降至 0.20%)。
Wasmer 借助 Codex 与 GPT-5.5 构建了面向边缘计算的 Node.js 运行时,开发速度提升 10x 到 20x,交付周期从数月缩短至数周。
OpenAI 公布其 AI 公共政策议程,涵盖安全、青少年保护、劳动力转型和全球标准,以确保 AI 造福社会。
OpenAI 发布美国前沿 AI 治理蓝图,提议建立联邦框架,覆盖安全、韧性与国家安全。该蓝图主张以民主方式治理前沿 AI,具体机制与实施细节尚未在原文中展开。
Reachy Mini 对话应用现已支持通过 MCP 调用托管在公开 Hugging Face Spaces 上的工具,用户只需执行 `reachy-mini-conversation-app tool-spaces add` 命令即可为机器人添加天气查询、网页搜索等能力,无需改动应用代码。
H Company 发布 Holo3.1 系列 Computer Use Agent 模型,基于 Qwen 家族,覆盖 0.8B、4B、9B 和 35B-A3B 四种尺寸,并首次提供 FP8、Q4 GGUF 和 NVFP4 量化权重。
推荐理由:原文给出跨环境、跨框架与本地量化部署的具体数据,可据此判断端侧 Computer Use Agent 的落地条件。
Travelers 基于 OpenAI 构建了 AI 理赔助手 Claim Assistant,用于引导客户完成理赔申报并提供 24/7 支持。该助手还能在理赔高峰期帮助 Travelers 扩展业务处理能力,目前已在全美范围内部署。
OpenAI 推出 ChatGPT Sites,用户可借助 Codex 创建轻量级网站或应用。目前官方仅给出这一句功能说明,未披露具体版本号、可用范围或技术细节。
OpenAI 为 Codex 推出插件、站点和标注功能,面向分析师、市场、设计师、投资者等团队。这些新能力旨在帮助不同角色借助 AI 完成更多工作,覆盖各类工具与工作流场景。
OpenAI 呼吁就青少年 AI 安全采取全球行动,提议设立一个国际机构,以加强针对青少年的防护措施、标准与机会。
OpenAI 的《The Next Era of Knowledge Work》报告探讨了 Codex 如何通过 AI 驱动的研究、数据分析、工作流自动化和内容创作提升生产力。
OpenAI 阐述其在 AI 政策与政治倡导上的做法,强调透明度、支持审慎监管与 AI 安全,并明确任何外部政治团体均不代表公司发声。
JetBrains 发布 Mellum2,一个从零训练、覆盖自然语言与代码的 12B 参数 MoE 模型,每个 token 仅激活 2.5B 参数,以 Apache 2.0 许可开源。官方称其在相近规模模型中基准表现有竞争力,推理速度超过 2 倍,可用于路由、RAG、摘要、子智能体和高吞吐编码场景。模型已在 Hugging Face 提供下载,技术报告发布在 arXiv(2605.31268)。
推荐理由:JetBrains 开源 12B MoE 模型,每 token 仅激活 2.5B 参数,读者可据此判断它在多模型系统中的定位。
Hugging Face 博客提出,企业 AI 规模化落地的关键不在 LLM 本身,而在"Agent 逻辑"——即知识图谱、算法、程序分析库等运行于智能体层的软件原语,可引导 LLM 聚焦企业工作流、压缩上下文空间。
OpenAI 在密歇根破土动工一个 1GW 数据中心项目,属于 Stargate 计划的一部分。该项目建设 AI 基础设施,目标是扩大使用范围、创造就业并支持当地社区。
OpenAI 前沿模型与 Codex 现已在 AWS 上正式可用,企业可通过现有的 AWS 环境、管控和采购流程接入 OpenAI。客户可在 AWS 上开始使用 OpenAI,更快从评估走向生产部署。
OpenAI 封禁了一批疑似来自中国的账号,这些账号使用 AI 生成关于美国科技政策、关税和贸易限制的评论与漫画。该活动被 OpenAI 称为“Tech and Tariffs”行动,目标指向美国科技政策。
OpenAI 封禁了一个疑似源自中国的账号集群,该集群利用 AI 生成批评美国数据中心和 AI 基础设施的社交媒体内容。这一行动被命名为“Data Center Bandwagon”campaign,针对美国开展影响力活动。
Braintrust 工程师使用 Codex 搭配 GPT-5.5 来运行实验并加快编码速度。
波士顿儿童医院借助 OpenAI 技术改善患者护理、减轻运营负担,并帮助确诊了 40 多例罕见病病例。
OpenAI 推出 Rosalind Biodefense,扩大 GPT-Rosalind 的可信访问范围,面向经过审核的开发者以及美国政府合作方。该计划用于生物防御、公共卫生和大流行病防范方向的前沿 AI 应用。
Hugging Face 发布 PyTorch 性能分析系列第一篇,讲解如何用 torch.profiler 分析矩阵乘法加法运算。教程基于 PyTorch 2.13 和 NVIDIA A100-SXM4-80GB,介绍 profiler 表格与 trace 两种产物的用法,并演示 torch.compile 对执行链路的影响。
OpenAI 分享了一套针对第三方 AI 评估的指南,覆盖如何评估前沿系统的模型能力、防护措施与评估有效性。该指南面向前沿模型的第三方评测场景,强调评估的可信度。
Google Research 在 I/O 2026 发布 Gemini for Science 实验工具套件,包含基于 ERA 与 AlphaEvolve 的 Computational Discovery、基于 Co-Scientist 的 Hypothesis Generation 以及基于 NotebookLM 的 Literature Insights。
Mistral 在 AI Now Summit 2026 上发布面向工业工程的集成 AI 栈,结合物理模型、工程经验与机器人技术,合作方包括 Airbus、BMW 和 ASML,用于加速设计、消除仿真瓶颈并优化资产性能。
推荐理由:Mistral 把工业工程 AI 栈、Vibe 智能体和自建推理数据中心放在一起发布,可看其企业级全栈布局。
Mistral 将 Le Chat 升级为统一 AI 智能体 Vibe,一个许可证同时覆盖工作与编码场景,原有对话、设置和套餐全部保留。
推荐理由:Mistral 把 Le Chat 升级为统一智能体 Vibe,读者可据此了解其工作模式与编码模式的能力边界和定价分层。
Endava 借助 Codex 构建智能体组织,将需求分析周期从数周缩短至数小时,并加速软件交付。
OpenAI 发布 Frontier Governance Framework,说明其 AI 安全、安保与风险管理实践如何对齐欧盟和加州正在成形的法规。该框架聚焦前沿模型的治理与合规衔接。