Zenken 借助 ChatGPT Enterprise 提升精简销售团队效率
Zenken 在全公司范围部署 ChatGPT Enterprise,提升了销售业绩、缩短了准备时间并提高了提案成功率。AI 支持的工作流帮助这支精简团队实现更个性化、更有效的客户互动。
Zenken 在全公司范围部署 ChatGPT Enterprise,提升了销售业绩、缩短了准备时间并提高了提案成功率。AI 支持的工作流帮助这支精简团队实现更个性化、更有效的客户互动。
Google Research 在 Science Advances 发表论文,介绍 NeuralGCM 直接使用 2001 至 2018 年 NASA 卫星降水观测训练其机器学习部分,而非依赖再分析数据。
推荐理由:NeuralGCM 改用卫星降水观测训练后,在 15 天预报与数十年气候模拟中对比 ECMWF 等模型的误差变化值得关注。
Berkeley AI Research 提出一种基于互信息的成像系统评估与优化框架,可直接从含噪测量中估计信息量,预测系统性能。该方法在彩色摄影、射电天文、无透镜成像和显微镜四个领域验证有效,优化后的设计达到端到端方法水平,且内存和计算需求更低、无需任务专用解码器。相关成果发表于 NeurIPS 2025 论文。
OpenAI 与软银集团合作 SB Energy,开发多吉瓦级 AI 数据中心园区,其中包括一座 1.2 GW 的得州设施,用于支持 Stargate 计划。
Datadog 使用 OpenAI 的 Codex 进行系统级代码审查。该实践将 Codex 应用于系统层面的代码审查工作。
OpenAI 推出 OpenAI for Healthcare,提供安全的企业级 AI 并支持 HIPAA 合规。该产品旨在减轻行政负担并支持临床工作流。
Netomi 借助 GPT-4.1 和 GPT-5.2 扩展企业级 AI 智能体,通过并发、治理与多步推理支撑可靠的生产工作流。该方案面向企业生产环境,强调智能体系统在规模化部署中的稳定性与可控性。
Tolan 基于 GPT-5.1 打造了一款语音优先的 AI 伴侣,结合低延迟响应、实时上下文重建和记忆驱动的人格设定,实现自然对话。
OpenAI 推出 ChatGPT Health,这是一个独立的使用体验,可安全连接用户的健康数据与 App。该功能强调隐私保护,并采用由医生参与设计的方案。
推荐理由:OpenAI 推出独立的健康使用场景,读者可了解它如何接入健康数据与 App 并处理隐私。
NVIDIA 发布面向物理 AI 的开源推理视觉语言模型 Cosmos Reason 2,提供 2B 和 8B 两种参数规模,并在 Physical AI Bench 与 Physical Reasoning 榜单上成为排名第一的开源模型。
推荐理由:Cosmos Reason 2 把上下文从 16K 扩到 256K 并新增轨迹与 2D/3D 定位能力,可据此判断物理 AI 智能体的视频理解边界。
Hugging Face 发布 Falcon-H1-Arabic 阿拉伯语模型家族,含 3B、7B、34B 三个规模,采用 Mamba 与 Transformer 注意力并行的 Falcon-H1 混合架构。
NVIDIA 在 CES 2026 发布博客,给出用 DGX Spark 与 Reachy Mini 搭建桌面个人智能体的分步教程,演示代码已开源。
OpenAI Grove 第二期已开放申请,这是一个为期 5 周的创始人项目,面向从仅有想法到已有产品的任何阶段参与者。入选者可获得 5 万美元 API 额度、AI 工具早期访问权限以及 OpenAI 团队的实操指导。
Google DeepMind 回顾 2025 年 8 大研究突破,模型能力从 Gemini 2.5(3 月)推进到 Gemini 3(11 月)与 Gemini 3 Flash(12 月)。
Hugging Face 发布 8B 参数安全护栏模型 AprielGuard,可检测 16 类安全风险及提示注入、越狱、思维链污染、记忆投毒、多智能体攻击等对抗攻击,并覆盖工具调用与推理轨迹等智能体工作流。模型提供推理与非推理两种模式,兼顾可解释分类与低延迟生产部署。训练数据由 Mixtral-8x7B 等合成生成,并借助 NVIDIA NeMo Curator 构建多轮对话攻击数据集。
OpenAI 宣布全球客户数突破 100 万。PayPal、Virgin Atlantic、BBVA、Cisco、Moderna 和 Canva 等公司正借助 OpenAI 改变工作方式。
OpenAI 正在用强化学习训练的自动化红队加固 ChatGPT Atlas,抵御提示词注入攻击。这一发现与修补的循环可提前识别新型攻击手法,在 AI 愈发智能体的趋势下强化浏览器智能体的防御。
Google Research 回顾 2025 年进展:Gemini 3 成为 Google 事实性最强的 LLM,在 SimpleQA Verified 和 FACTS 基准上达到 SOTA,并在 Gemini 3 中引入生成式 UI,可动态生成网页、游戏、工具等交互界面。
OpenAI 推出针对思维链可监控性的新框架与评测套件,覆盖 24 种环境下的 13 项评估。结果显示,监控模型内部推理远比仅监控输出更有效,为 AI 系统能力提升后的可扩展控制提供了可行路径。
OpenAI 更新 Model Spec,新增 Under-18 Principles,规定 ChatGPT 应基于发展科学为青少年提供安全、适龄的引导。此次更新强化了防护栏,明确了模型在更高风险情境下的预期行为,并延续了 OpenAI 改善 ChatGPT 青少年安全的整体工作。
OpenAI 与美国能源部签署谅解备忘录,深化在 AI 与先进计算领域的合作,以支持科学发现。该协议基于双方与国家实验室的现有工作,为在能源部生态系统中将 AI 应用于高影响力研究建立框架。
OpenAI 发布面向青少年与家长的 AI 素养资源,帮助其审慎、安全、自信地使用 ChatGPT。指南包含经专家审核的建议,涵盖负责任使用、批判性思维、健康边界,以及如何支持青少年应对情绪或敏感话题。
OpenAI 发布 GPT-5.2-Codex,称其为自家最先进的编码模型。该模型主打长程推理、大规模代码转换和增强的网络安全能力。
推荐理由:OpenAI 官方给出 GPT-5.2-Codex 的定位与三项能力方向,可据此了解其编码模型的最新迭代重点。
OpenAI 发布 GPT-5.2 System Card 的增补内容,涉及 GPT-5.2-Codex。原文正文抓取失败,仅标题可用。
Transformers v5 重新设计了 tokenizer 的工作方式,将 tokenizer 架构与训练好的词表分离,类似 PyTorch 把网络结构与学习到的权重分开。新设计带来更清晰的内部结构、干净的类层级和单一快速后端,让 tokenizer 可检查、可定制、可从零训练。
Mistral AI 发布 Mistral OCR 3,在表单、扫描件、复杂表格和手写内容上相对 Mistral OCR 2 的整体胜率为 74%。
推荐理由:官方给出与 Mistral OCR 2 的胜率对比、每千页定价和自托管选项,便于评估文档解析成本与合规。
NVIDIA 发布 Nemotron 3 Nano 30B A3B,并公开其完整评测配方,基于开源库 NeMo Evaluator 构建,任何人可复现评测流程并独立核查结果。
Google DeepMind 发布 Gemini 3 Flash,将 Gemini 3 的推理能力与 Flash 级延迟、效率和成本结合,定价为 $0.50/1M 输入 tokens、$3/1M 输出 tokens。
推荐理由:官方给出 Gemini 3 Flash 的基准分数、定价与上线渠道,读者可据此判断它在速度与成本上的取舍。
OpenAI 联合 American Journalism Project 和 The Lenfest Institute 推出 OpenAI Academy for News Organizations,帮助新闻编辑室有效使用 AI。该学习中心为记者、编辑和出版方提供培训、实用案例与负责任使用指南,支持其在报道和运营中采用 AI。
OpenAI 宣布开发者可以向 ChatGPT 提交应用,经审核通过后会在产品内新的应用目录中展示,便于用户发现。官方同时更新了工具、指南和 Apps SDK,帮助开发者构建把真实操作带入 ChatGPT 的对话原生体验。
推荐理由:OpenAI 开放 ChatGPT 应用提交与审核入口,开发者可据此判断自家应用进入该生态的路径。
OpenAI 发布企业 AI 应用现状报告,基于数据展示企业如何从试验阶段走向实际生产力提升与新能力获取。
Google DeepMind 发布 Gemma Scope 2,一套覆盖 Gemma 3 全系列(270M 到 27B 参数)的开源可解释性工具,结合稀疏自编码器(SAEs)和 transcoders 查看模型内部计算。
推荐理由:Gemma Scope 2 覆盖 Gemma 3 全尺寸并新增跨层工具,读者可了解开源可解释性工具当前能审计哪些模型行为。
OpenAI 发布 FrontierScience 基准,用于测试 AI 在物理、化学和生物学领域的推理能力,衡量其向真实科学研究迈进的进展。
OpenAI 提出一套真实世界评估框架,用于衡量 AI 在湿实验室中加速生物学研究的能力,并用 GPT-5 优化分子克隆实验方案。该工作同时探讨了 AI 辅助实验的前景与风险。
OpenAI 发布 ChatGPT Images 体验与 API 中的 GPT-Image-1.5,主打更快的图像生成。原文提到可进一步了解最新的 ChatGPT Images 2.5。
OpenAI 提出领导者可通过清晰的战略、培训、治理和加速创新来打造 AI-ready 组织。内容围绕组织如何在 AI 时代保持竞争力展开,强调战略、培训、治理与创新加速四个方向。
Google Research 为 STOC 2026 打造实验性 Paper Assistant Tool(PAT),基于 Gemini 2.5 Deep Think 的推理扩展方法,在投稿后 24 小时内给出结构化预审反馈。
推荐理由:Google 披露 PAT 在 STOC 2026 的试用数据,读者可据此判断 AI 预审在数学证明类写作中的实际边界。
CUGA(Configurable Generalist Agent)是 IBM Research 推出的开源可配置通用智能体,采用 Apache 2.0 许可,现已集成到 Hugging Face Spaces 供试用。
Google DeepMind 发布升级版 Gemini 2.5 Flash Native Audio,面向实时语音智能体,在函数调用、指令遵循和多轮对话三方面做了改进。
推荐理由:官方给出 Gemini 2.5 Flash Native Audio 在函数调用、指令遵循和多轮对话上的具体提升数据,可据此判断语音智能体的可用性变化。
Google 联合 SisonkeBiotik、Ro'ya 和 DS-I Africa 举办非洲健康数据科学 Ideathon,从 30 多份提交中选出六支决赛团队,围绕 MedGemma、TxGemma 和 MedSigLIP 等开放健康 AI 模型开发解决方案。