BBVA 与 OpenAI 合作推进全球银行业 AI 转型
BBVA 与 OpenAI 达成多年期 AI 转型合作,将向全部 120,000 名员工部署 ChatGPT Enterprise。双方将共同开发 AI 解决方案,用于改善客户交互、简化运营流程,并打造 AI 原生的银行体验。
BBVA 与 OpenAI 达成多年期 AI 转型合作,将向全部 120,000 名员工部署 ChatGPT Enterprise。双方将共同开发 AI 解决方案,用于改善客户交互、简化运营流程,并打造 AI 原生的银行体验。
BNY 正通过 OpenAI 在全企业范围扩大 AI 应用,其平台 Eliza 已支持 20000 多名员工构建 AI 智能体,以提升效率并改善客户成果。
OpenAI 借助 Codex 在 28 天内完成 Android 版 Sora 的交付,AI 辅助的规划、翻译与并行编码工作流帮助一支精简团队实现了快速且可靠的开发。
llama.cpp server 新增 router 模式,可在不重启服务的情况下动态加载、卸载和切换多个模型,实现类似 Ollama 的模型管理。
推荐理由:llama.cpp server 新增 router 模式,读者可了解本地多模型动态加载与切换的具体用法和配置项。
OpenAI 发布 GPT-5.2,称其为目前数学与科学能力最强的模型,在 GPQA Diamond 和 FrontierMath 等基准上取得新的 SOTA 结果。官方表示这些提升已转化为实际研究进展,包括解决一个开放理论问题并生成可靠的数学证明。
推荐理由:原文给出 GPT-5.2 在 GPQA Diamond 与 FrontierMath 上的新结果,读者可据此了解其在数学与科研任务上的能力边界。
Google DeepMind 宣布与英国 AI Security Institute(AISI)签署新谅解备忘录,将合作从模型测试扩展到基础安全与安全研究。双方将共享专有模型、数据与思路,并发布联合报告,重点研究 CoT 监控、社会情感错位及 AI 对经济系统的影响。该合作是 Google DeepMind 与英国政府推进安全 AI 整体协作的一部分。
OpenAI 发布 GPT-5 系统卡更新,将 GPT-5.2 纳入 GPT-5 系列,成为该系列最新模型家族。GPT-5.2 的综合安全缓解方案与 GPT-5 系统卡、GPT-5.1 系统卡中描述的基本一致。与 OpenAI 其他模型一样,GPT-5.2 的训练数据包括互联网公开信息、通过第三方合作获取的信息,以及用户或人类训练师与研究人员提供或生成的信息。
推荐理由:GPT-5.2 系统卡更新说明其安全缓解方案延续 GPT-5 与 GPT-5.1 的框架,可对照前代了解安全策略的连续性。
Podium 基于 OpenAI 的 GPT-5 构建了 AI 队友“Jerry”,为 10,000+ 中小企业提供服务,并带来 300% 增长。该智能体正在改变实体商家服务客户的方式。
OpenAI 回顾成立十年来的进展,从早期研究突破到被广泛使用、重塑可能性的 AI 系统。公司分享了过去十年的经验教训,并表示仍对构建造福全人类的 AGI 保持乐观。
迪士尼与 OpenAI 达成协议,将把迪士尼、漫威、皮克斯和星球大战的 200 多个角色引入 Sora,用于粉丝创作的短视频。协议强调娱乐领域的负责任 AI,并包含迪士尼在全公司范围使用 ChatGPT Enterprise 和 OpenAI API。
推荐理由:协议披露了迪士尼角色进入 Sora 的范围,以及迪士尼全公司采用 ChatGPT Enterprise 与 OpenAI API 的配套安排。
OpenAI 发布 GPT-5.2,称其为面向日常专业工作最先进的前沿模型,具备最先进的推理、长上下文理解、编码和视觉能力。该模型可在 ChatGPT 和 OpenAI API 中使用,用于支撑更快、更可靠的智能体工作流。
推荐理由:OpenAI 公布 GPT-5.2 在推理、长上下文、编码与视觉上的定位,读者可据此判断日常专业工作与智能体流程的升级方向。
Hugging Face 发布教程,展示如何让 OpenAI Codex 借助 Hugging Face Skills 仓库完成端到端模型微调实验。
推荐理由:原文给出可复用的 HF-skills 配置与端到端微调流程,读者可据此把训练实验交给编码智能体执行。
Google Research 在 COLM 2025 论文中提出 Urania 框架,通过 DP 聚类与 DP 关键词提取,从 LLM 聊天记录中生成带端到端差分隐私保证的使用洞察。该框架让 LLM 只基于匿名关键词生成摘要,不接触原始对话,从而抵御提示注入等泄露风险。评测中 DP 摘要被 LLM 评审偏好的比例最高达 70%,但隐私预算收紧会降低主题覆盖度。
Google DeepMind 宣布深化与英国政府的合作,聚焦用 AI 加速科学发现、教育、公共服务现代化及国家安全。合作将向英国科学家优先开放 AlphaEvolve、AlphaGenome、AI co-scientist 和 WeatherNext 等"AI for Science"模型,并于 2026 年在英国建立其首个自动化材料科学实验室。
OpenAI 正随着 AI 模型在网络安全领域能力增强而投入更强的防护措施与防御能力。公司说明了其如何评估风险、限制滥用,并与安全社区合作强化网络韧性。
Scout24 基于 GPT-5 打造了一款对话式助手,通过追问澄清、生成摘要和个性化房源推荐,重新定义房产搜索体验。
Mistral AI 发布新一代编码模型家族 Devstral 2,包含 123B 的 Devstral 2 和 24B 的 Devstral Small 2,两者均为开源模型,分别采用修改版 MIT 和 Apache 2.0 许可。
推荐理由:官方给出两款开源编码模型的参数、许可与 SWE-bench 成绩,并附与闭源模型的对比,便于判断开源编码模型的当前水位。
Google DeepMind 联合 Kaggle 发布 FACTS Benchmark Suite,在原有 FACTS Grounding 基础上新增 Parametric、Search、Multimodal 三项基准,并将 Grounding 升级至 v2,共 3,513 个公开样例。
OpenAI 在 Linux 基金会下联合发起 Agentic AI Foundation,并将 AGENTS.md 捐赠给该基金会。该基金会旨在支持开放、可互操作的标准,以推动安全智能体 AI 的发展。
推荐理由:OpenAI 把 AGENTS.md 捐给 Linux 基金会下的新基金会,读者可据此了解智能体标准与开源治理的走向。
OpenAI 推出首批 OpenAI Certifications 认证及 AI Foundations 课程,帮助人们建立实用 AI 技能、提升职业机会并适应未来工作。课程内容围绕真实场景的 AI 能力培养,面向希望获得认证的学习者。
澳大利亚联邦银行与 OpenAI 合作,将 ChatGPT Enterprise 部署到 5 万名员工,以规模化提升 AI 应用能力。该行希望借此改善客户服务与欺诈响应。
OpenAI 任命 Denise Dresser 为首席营收官,负责统管全球营收战略,覆盖企业业务与客户成功。她将帮助更多企业把 AI 投入日常运营,配合 OpenAI 的持续扩张。
OpenAI 与 Deutsche Telekom 合作,为欧洲数百万用户带来先进的多语言 AI 体验。ChatGPT Enterprise 也将部署给 Deutsche Telekom 员工,用于改进工作流程并加速创新。
OpenAI 与 Instacart 深化长期合作,将首个完全集成的杂货购物与 Instant Checkout 支付应用引入 ChatGPT。
OpenAI 的企业数据显示,2025 年各行业 AI 采用正在加速、集成程度加深,并带来可衡量的生产力提升。
Virgin Atlantic 正在用 AI 加速开发、改善决策并提升客户体验,该公司 CFO Oliver Byers 分享了这些应用。
Hugging Face 推出 Swift 包 swift-huggingface,为 Hub 提供完整客户端,可独立使用,后续将并入 swift-transformers 替换现有 HubApi。它支持断点续传与进度追踪、与 Python 生态共享的缓存结构、TokenProvider 认证模式和 OAuth 2.0,Xet 存储后端支持即将上线。
Google Research 发布 Titans 架构与 MIRAS 理论框架,将深度神经网络作为长期记忆模块,结合 RNN 的速度与 Transformer 的精度。
推荐理由:Google Research 提出 Titans 架构与 MIRAS 框架,用深度神经网络做长期记忆模块,读者可了解长上下文建模的新思路。
OpenAI 宣布推出 OpenAI for Australia,用于建设主权 AI 基础设施、为超过 150 万名工作者提供技能培训,并加速澳大利亚 AI 生态的创新。
密歇根州立大学 Berkley Walker 团队借助 AlphaFold 预测植物与嗜热藻类中光合作用关键酶 GLYK 的 3D 结构,发现植物版 GLYK 的三个柔性环在高温下变形失稳。研究人员据此用藻类 GLYK 中更刚性的环替换植物版的不稳定环,构建出杂合酶,其中一种在高达 65 °C 下仍保持稳定。
Intel AI Software Group 推出 DeepMath,一个基于 Qwen3-4B Thinking 并用 GRPO 微调的数学推理 Agent,通过 smolagents 实现,让模型生成 Python 片段在沙箱中执行并回填结果。
Hugging Face 发布 Hugging Face Skills,其中 hf-llm-trainer 技能让 Claude Code、Codex、Gemini CLI 等编码智能体直接提交云端 GPU 训练任务、监控进度并把模型推送到 Hub。
推荐理由:原文给出 hf-llm-trainer 技能的安装命令与完整训练流程,读者可据此让编码智能体代跑微调任务。
Google Research 在 NeurIPS 2025 发布 Massive Sound Embedding Benchmark(MSEB),用统一框架评估声音嵌入在检索、推理、分类、转录、分割、聚类、重排、重建八项任务上的表现。
OpenAI 研究人员正在测试一种名为"confessions"的方法,训练模型在犯错或做出不当行为时主动承认,以提升 AI 的诚实性、透明度以及人们对模型输出的信任。
OpenAI 宣布收购 Neptune,以更深入地观察模型行为,并强化研究人员用于追踪实验和监控训练的工具。
推荐理由:OpenAI 收购 Neptune 的官方说明,交代了它在模型行为追踪与训练监控上的用途。
OpenAI Foundation 公布 People-First AI Fund 首批受资助名单,向 208 家非营利组织提供总额 4050 万美元的无限制资助,用于支持社区创新与机会。
Mistral AI 发布 Mistral 3 系列,包括 Mistral Large 3 和 3B、8B、14B 三个尺寸的 Ministral 3,全部以 Apache 2.0 许可开源。
推荐理由:Mistral 3 一次性放出从 3B 到 675B 的 Apache 2.0 模型家族,读者可据此判断开源权重在端侧与前沿两端的覆盖范围。
Mirakl 正借助 AI 智能体与 ChatGPT Enterprise 重塑电商,实现更快的文档撰写和更智能的客户支持,并朝智能体原生电商方向发展。该公司还在构建 Mirakl Nexus,以推进其智能体电商愿景。
OpenAI 拨款最高 200 万美元,资助 AI 与心理健康交叉领域的研究。该计划支持研究现实世界风险、收益与应用的项目,以提升安全性与福祉。
OpenAI 与 NORAD 合作为“NORAD Tracks Santa”推出三款 ChatGPT 节日工具,让家庭可以生成节日精灵、玩具涂色页和定制圣诞故事。