Hugging Face 与 SkyPilot 联合推出零出网费存储集成
Hugging Face 与 SkyPilot 联合推出集成,用户可用一个 hf:// URL 和现有 HF_TOKEN 把 Hugging Face Bucket 或任意模型、数据集、Space 仓库挂载进 SkyPilot 任务,并在 20+ 云、Kubernetes、Slurm 和本地集群上运行。
推荐理由:原文给出 hf:// 挂载方式、免出网费与 Xet 去重的具体机制,读者可据此判断跨云训练存储成本的变化。
Hugging Face 与 SkyPilot 联合推出集成,用户可用一个 hf:// URL 和现有 HF_TOKEN 把 Hugging Face Bucket 或任意模型、数据集、Space 仓库挂载进 SkyPilot 任务,并在 20+ 云、Kubernetes、Slurm 和本地集群上运行。
推荐理由:原文给出 hf:// 挂载方式、免出网费与 Xet 去重的具体机制,读者可据此判断跨云训练存储成本的变化。
Hugging Face 为 Kernels 项目引入 Hub 上的 "kernel" 新仓库类型,并默认只加载受信任发布者的内核,其他来源需显式传入 trust_remote_code=True。
Hugging Face 与 Cerebras 联合演示了一套实时语音到语音流水线,用 Cerebras 加速 Gemma 4 31B 的推理,以降低语音交互延迟。
推荐理由:原文给出可替换的语音到语音流水线各层组件,读者可据此评估如何搭建低延迟实时语音交互。
Google Research 将建筑级屋顶反射率数据集从 14 城扩展至 50+ 城市,覆盖 9 个国家,并通过新的 Heat Resilience Earth Engine App 开放访问。该方法融合 Sentinel-2 与 30-cm 高分辨率卫星影像,在 Boulder 验证中 RMSE 仅 0.04,建模显示针对性冷屋顶规划可使全球城市极端高温降低最多 0.5°C。
Hugging Face 模型页现已展示 Every Eval Ever(EEE)评测结果,EEE 与 Hugging Face Community Evals 实现互操作,支持结果交叉发布与溯源。
Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前它仅作为独立的 Gemini 2.5 computer use 模型提供。
推荐理由:原文说明 computer use 从独立模型并入 Gemini 3.5 Flash 主模型,并给出 API 与安全防护入口,便于判断智能体落地的可用性。
NVIDIA 在 Hugging Face 博客发布开源库 NeMo AutoModel,基于 Transformers v5 构建,新增 Expert Parallelism。
Mistral 为 Connectors 推出多项新能力:管理员控制、带 connector 作用域的 API key、多账号 connector 与 Connectors Debugger 均已 GA 或进入 Public Preview。
Omio 正借助 OpenAI 构建对话式旅行体验,并推动自身转型为 AI 原生公司。该案例还展示了 Omio 如何用 OpenAI 加速产品开发。
OpenAI 推出新的 Daybreak 工具,包括 Codex Security 和 GPT-5.5-Cyber,帮助各类组织大规模发现、验证并修补漏洞。
推荐理由:OpenAI 推出面向安全场景的 Daybreak 工具,读者可了解其漏洞发现与修复的定位。
OpenAI 为 ChatGPT Enterprise 新增支出控制与用量分析功能,帮助企业管理成本并扩展 AI 应用。
OpenAI 用 GPT-5.5 Instant 改进 ChatGPT 的健康与养生回答,强化推理、上下文理解与表达清晰度,并引入医生参与设计的评估。该版本针对健康类问题优化,具体上线范围与参数未披露。
Hugging Face 发布 Agentic Resource Discovery(ARD)规范的参考实现 Discover Tool,让智能体在运行时按自然语言搜索能力,而不再依赖预先安装。
推荐理由:Hugging Face 给出 ARD 规范的参考实现与 CLI、REST、MCP 三种调用入口,可据此判断智能体能力发现如何从预装目录转向运行时检索。
Google DeepMind 与英国政府、Google Cloud、Faculty 及 Barnet、Dorset、Camden 地方规划部门合作,开发基于 Gemini 的规划审批原型工具,目标是把住户规划申请的处理时间缩短 50%。
OpenAI 推出三门 Academy 新课程,帮助人们建立实用 AI 技能、创建可复用工作流,并在日常工作中应用智能体。课程聚焦实际动手能力与可重复流程,面向下一阶段的工作方式。
Preply 借助 OpenAI 推出 AI 生成的课程总结,为语言学习提供个性化反馈与练习。该功能将 AI 与真人导师结合,用于个性化学习体验。
天体物理学家 Chi-kwan Chan 使用 OpenAI 的 Codex 构建黑洞模拟,帮助科学家研究极端物理并检验爱因斯坦的广义相对论。
OpenAI 模型与 Codex 现可通过 Oracle Cloud 访问,企业可使用已有的云承诺额度来构建和部署 AI。该方式支持企业级安全与治理。
Notion 借助 Codex 一次性生成规格说明、为网页端构建 AI Voice Input,并在小团队中放大工程产能。
Hugging Face 宣布 OpenEnv 改由委员会协调,成员包括 Meta-PyTorch、Reflection、Unsloth、Modal、Prime Intellect、Nvidia、Mercor、Fleet AI、Microsoft、Hugging Face 和 RadixArk,项目迁至 huggingface/OpenEnv。
推荐理由:OpenEnv 从单一项目转为多方共管的协议层,读者可据此了解开源智能体 RL 环境的协作方式与接入路径。
Google 在 Gemini Enterprise Agent Platform 上推出由 Agentic RAG 驱动的跨语料检索公开预览版,通过规划、改写、路由与充分上下文智能体迭代检索多源数据。官方称相比标准 RAG,该框架在事实性数据集上准确率最高提升 34%;在跨语料设置下从 4 个候选语料中正确路由并答对 90.1% 的问题,单语料与跨语料版本延迟差异平均在 3% 以内。
推荐理由:原文给出多智能体 RAG 的完整流程与跨语料评测数据,读者可据此判断它在多源检索场景下的可用性。
Endava 正利用 AI 智能体、ChatGPT Enterprise 和 Codex 加速软件交付并自动化工作流,在企业内部构建 AI 原生文化。
OpenAI 为 ChatGPT 引入名为 Dreaming 的新记忆系统,用于更好地记住用户偏好,并在多轮对话之间保持上下文的时效性和相关性。
推荐理由:原文给出 ChatGPT 记忆系统的新变化,读者可据此了解跨对话上下文保持方式的调整。
Hugging Face 重构官方命令行工具 hf CLI,使其同时服务人类用户和 Claude Code、Codex、Cursor 等编码智能体,通过环境变量自动识别智能体并切换输出格式。
Wasmer 借助 Codex 与 GPT-5.5 构建了面向边缘计算的 Node.js 运行时,开发速度提升 10x 到 20x,交付周期从数月缩短至数周。
Reachy Mini 对话应用现已支持通过 MCP 调用托管在公开 Hugging Face Spaces 上的工具,用户只需执行 `reachy-mini-conversation-app tool-spaces add` 命令即可为机器人添加天气查询、网页搜索等能力,无需改动应用代码。
Travelers 基于 OpenAI 构建了 AI 理赔助手 Claim Assistant,用于引导客户完成理赔申报并提供 24/7 支持。该助手还能在理赔高峰期帮助 Travelers 扩展业务处理能力,目前已在全美范围内部署。
OpenAI 推出 ChatGPT Sites,用户可借助 Codex 创建轻量级网站或应用。目前官方仅给出这一句功能说明,未披露具体版本号、可用范围或技术细节。
OpenAI 为 Codex 推出插件、站点和标注功能,面向分析师、市场、设计师、投资者等团队。这些新能力旨在帮助不同角色借助 AI 完成更多工作,覆盖各类工具与工作流场景。
OpenAI 的《The Next Era of Knowledge Work》报告探讨了 Codex 如何通过 AI 驱动的研究、数据分析、工作流自动化和内容创作提升生产力。
OpenAI 前沿模型与 Codex 现已在 AWS 上正式可用,企业可通过现有的 AWS 环境、管控和采购流程接入 OpenAI。客户可在 AWS 上开始使用 OpenAI,更快从评估走向生产部署。
Braintrust 工程师使用 Codex 搭配 GPT-5.5 来运行实验并加快编码速度。
OpenAI 推出 Rosalind Biodefense,扩大 GPT-Rosalind 的可信访问范围,面向经过审核的开发者以及美国政府合作方。该计划用于生物防御、公共卫生和大流行病防范方向的前沿 AI 应用。
Mistral 在 AI Now Summit 2026 上发布面向工业工程的集成 AI 栈,结合物理模型、工程经验与机器人技术,合作方包括 Airbus、BMW 和 ASML,用于加速设计、消除仿真瓶颈并优化资产性能。
推荐理由:Mistral 把工业工程 AI 栈、Vibe 智能体和自建推理数据中心放在一起发布,可看其企业级全栈布局。
Mistral 将 Le Chat 升级为统一 AI 智能体 Vibe,一个许可证同时覆盖工作与编码场景,原有对话、设置和套餐全部保留。
推荐理由:Mistral 把 Le Chat 升级为统一智能体 Vibe,读者可据此了解其工作模式与编码模式的能力边界和定价分层。
Endava 借助 Codex 构建智能体组织,将需求分析周期从数周缩短至数小时,并加速软件交付。
OpenAI、Thrive 和 Crete 用 Codex 构建了一个可自我改进的税务智能体,用于自动完成报税、提升准确率并加速工作流。该智能体面向税务申报场景,将申报流程自动化。
Warp 正押注用 GPT-5.5 及 OpenAI 模型协调本地、云端与开源开发流程中的编码智能体。该工具将编码智能体贯穿这三类工作流,是其在开源方向上的重要投入。
Hugging Face 在 TRL 中落地了增量权重同步(Delta Weight Sync):只把两次 RL 优化步之间真正变化的 bf16 权重编码成稀疏 safetensors 文件,上传到 Hugging Face Bucket,再由 vLLM 拉取应用。
推荐理由:TRL 的稀疏增量权重同步把异步 RL 每步传输量压到原来的百分之几,读者可据此判断跨集群训练的成本边界。
Virgin Atlantic 借助 Codex 在固定的假日出行截止期限前完成移动应用改版上线,实现接近全覆盖的单元测试和零 P1 缺陷。