OpenAI 如何保障 AI 智能体点击链接时的数据安全
OpenAI 说明了 AI 智能体打开链接时保护用户数据的机制,通过内置防护防止基于 URL 的数据外泄和提示词注入。
OpenAI 说明了 AI 智能体打开链接时保护用户数据的机制,通过内置防护防止基于 URL 的数据外泄和提示词注入。
Google Research 提出 ATLAS 多语言缩放定律,基于 774 次训练运行、10M–8B 参数模型、400+ 语言数据,可指导模型规模与语言配比选择。其跨语言迁移矩阵显示,支持语言数翻倍时模型规模需增至 1.18 倍、数据量增至 1.66 倍。该研究将发表于 ICLR 2026。
Mistral 发布终端编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型系列驱动,新增自定义子智能体、多选项澄清、斜杠命令技能和统一智能体模式,CLI 修复持续自动更新。
推荐理由:官方给出 Vibe 2.0 的自定义子智能体、斜杠命令技能与定价变化,可据此判断终端编码智能体的使用成本与工作流。
中国开源模型社区已近乎一致转向 MoE 架构,Kimi K2、MiniMax M2、Qwen3 均采用该路线,以在成本约束下兼顾能力与灵活部署。开源活动从文本扩展到多模态与智能体,StepFun 的 Step-Audio-R1.1 语音模型性能超越闭源模型,腾讯开源 Hunyuan Video 与 Hunyuan 3D。
Hugging Face 团队推出 Alyah(阿联酋方言中意为"北极星")基准,用于评估阿拉伯语 LLM 对阿联酋方言的语言、文化与语用理解能力。该基准包含 1,173 个由阿联酋母语者手工收集的多选题样本,覆盖问候语、诗歌、 heritage 知识等七类内容。
Calvin Klein 与 Tommy Hilfiger 母公司 PVH Corp. 采用 ChatGPT Enterprise,将 AI 引入时装设计、供应链和消费者互动环节。
Hugging Face 博客复盘了用 verl 框架对 GPT-OSS 进行智能体强化学习训练时遇到的问题与修复。团队发现 GPT-OSS-20B 训练初期出现 KL 散度和熵爆炸、奖励不升,根因是 MoE 架构下双前向传播导致新旧 log-prob 不一致,使 PPO 的 importance sampling ratio 偏离 1;修复后该方案同样适用于 GPT-OSS-120B。
TRUSTBANK 与 Recursive 合作,基于 OpenAI 模型打造了 Choice AI,通过个性化对话式推荐简化故乡税(Furusato Nozei)礼品的挑选流程。
OpenAI 发布 Prism,一个内置 GPT-5.2 的免费 LaTeX 原生工作空间,面向研究人员,支持在同一处完成写作、协作与推理。
Indeed CRO Maggie Hulce 分享了 AI 如何改变求职、招聘与人才获取。她介绍了 AI 对雇主和求职者双方的影响。
Google 在 NeurIPS 2025 提出 GIST(Greedy Independent Set Thresholding)算法,用于训练数据子集选择,在多样性与效用之间取得平衡。GIST 是首个为该权衡提供可证明保证的算法,保证所选子集价值至少为最优解的一半,并在图像分类等基准任务上超越现有方法。
OpenAI 技术解析 Codex 智能体循环,说明 Codex CLI 如何借助 Responses API 编排模型、工具、提示词与性能。
Google Research 在 EMNLP 2025 发表的论文提出一种分解式方法,将用户意图理解拆为两步:先用小型多模态 LLM 逐屏总结交互,再从摘要序列中提取意图。在移动端和网页轨迹上,该方法优于 CoT 提示和端到端微调,Gemini 1.5 Flash 8B 配合该方法的意图提取效果可与 Gemini 1.5 Pro 相当,成本与速度仅为后者一小部分。
OpenAI 通过副本、缓存、限流和工作负载隔离,将 PostgreSQL 扩展至每秒数百万次查询,以支撑 8 亿 ChatGPT 用户。文章披露了这套架构在副本、缓存、限流与工作负载隔离方面的具体做法。
Praktika 基于 GPT-4.1 和 GPT-5.2 构建自适应 AI 导师,通过对话方式提供个性化课程、跟踪学习进度,帮助学习者实现真实场景的语言流利度。
OpenAI 发布了一份数据驱动报告,揭示各行业员工如何使用 ChatGPT 及 GPT-5,涵盖采用趋势、高频任务和部门使用模式。报告还探讨了 AI 在职场中的未来走向。
Mistral AI 团队在 vLLM 上排查一起内存泄漏,问题只在 Mistral Medium 3.1、开启图编译的 Prefill/Decode 分离部署中出现,系统内存以每分钟 400 MB 线性增长,数小时后触发 out of memory。Memray、Guppy 3 均未发现泄漏,Heaptrack 显示堆内存稳定但峰值 RSS 存在差异,说明泄漏发生在堆之外。
Higgsfield 借助 OpenAI 的 GPT-4.1、GPT-5 和 Sora 2,让创作者用简单输入即可生成电影级、适配社交平台的视频。
Hugging Face 发布 AssetOpsBench,一个面向工业资产运维的智能体评测基准,包含 2.3M 传感器遥测点、140+ 场景、4.2K 工单和 53 种结构化故障模式,覆盖 4 个智能体。
OpenAI 最新报告揭示各国在先进 AI 采用上存在显著差距,并提出新举措帮助各国从 AI 中获取生产力收益。报告聚焦于如何消除"能力过剩"(capability overhang)问题。
OpenAI 推出新计划 Edu for Countries,帮助各国政府利用 AI 现代化教育系统并培养面向未来的劳动力。该计划面向政府层面,聚焦教育系统升级与未来劳动力建设。
OpenAI 与盖茨基金会联合启动 Horizon 1000,一项 5000 万美元的试点项目,用于推进非洲医疗领域的 AI 能力。该计划目标是在 2028 年前覆盖 1000 家诊所。
OpenAI 公布 Stargate 社区计划,提出以社区优先的方式建设 AI 基础设施。该计划采用因地制宜的方案,由社区意见、能源需求与劳动力优先事项共同塑造。
Hugging Face 发布系列博客第一篇,回顾 DeepSeek 于 2025 年 1 月发布 R1 模型一年来中国开源 AI 生态的变化。文章称 R1 通过公开推理路径与后训练方法、采用 MIT 许可,降低了技术、采用和心理三重门槛,并成为 Hugging Face 历史上获赞最多的模型。
ServiceNow 扩大对 OpenAI 前沿模型的接入,用于驱动 ServiceNow 平台上的 AI 工作流、摘要、搜索与语音功能。该合作将 OpenAI 模型能力嵌入企业级工作流场景。
微软发布 Differential Transformer V2(DIFF V2),通过将查询头数翻倍、保持 KV 头数不变,使解码速度与标准 Transformer 持平,且无需自定义注意力 kernel。
ChatGPT 正在推出年龄预测功能,用于判断账户是否未满 18 岁,并对青少年账户应用相应保护措施,准确率将随时间持续优化。
Overworld 发布实时交互式视频扩散模型 Waypoint-1,可通过文本、鼠标和键盘控制,权重已上传 Hugging Face Hub,先开放 Waypoint-1-Small,Medium 版本即将推出。
推荐理由:Waypoint-1 把实时交互式视频扩散模型和推理库一并开源,读者可据此了解世界模型从控制输入到消费级硬件落地的路径。
OpenAI 的商业模式随智能水平提升而扩展,覆盖订阅、API、广告、商业和算力五条收入线,核心驱动力是 ChatGPT 采用率的持续加深。
Google DeepMind 发布 D4RT(Dynamic 4D Reconstruction and Tracking),一个统一 4D 场景重建与追踪的 AI 模型,采用编码器-解码器 Transformer 架构和查询机制,可同时完成点追踪、点云重建和相机位姿估计。
推荐理由:D4RT 把动态场景重建统一进单一查询式框架,读者可了解其速度提升与机器人、AR 等落地方向。
OpenAI 宣布 ChatGPT Go 已在全球上线,提供 GPT-5.2 Instant 的扩展访问、更高的使用额度和更长的记忆能力,让更多地区用户以更低成本使用其 AI 能力。
推荐理由:ChatGPT Go 面向全球开放,读者可据此了解 GPT-5.2 Instant 的可用范围与使用额度变化。
OpenAI 计划在美国为 ChatGPT 的免费版和 Go 版测试广告,以扩大 AI 的可负担使用范围。OpenAI 表示测试过程中会保护隐私、信任和回答质量。
推荐理由:OpenAI 首次说明 ChatGPT 免费版与 Go 版的广告测试范围,读者可据此了解其商业化与可及性策略的走向。
Google Research 提出一种基于时序卷积网络(TCN)的多头深度学习模型,仅用单只 Pixel Watch 的 IMU 信号(50 Hz 三轴加速度计与陀螺仪)加用户身高,即可直接估算步速、步长、摆动时间、支撑时间和双脚支撑时间等步态指标。
OpenAI 投资 Merge Labs,支持其研发连接生物智能与人工智能的新型脑机接口,目标是最大化人类能力、自主性与体验。
OpenAI 发起、开源社区共建、Hugging Face 生态支持的 Open Responses 发布,它基于 Responses API 开源扩展,定位为面向智能体的开放推理标准。
推荐理由:原文给出 Open Responses 的规范要点与迁移差异,读者可据此判断现有 Responses API 客户端需要改什么。
OpenAI 发起一项新的 RFP,旨在通过加速本土制造、创造就业和扩展 AI 基础设施来强化美国 AI 供应链。
OpenAI 宣布与 Cerebras 合作,新增 750MW 高速 AI 算力,用于降低推理延迟,让 ChatGPT 在实时 AI 负载下响应更快。
推荐理由:OpenAI 与 Cerebras 达成算力合作,读者可了解其 750MW 高速算力对推理延迟和 ChatGPT 实时负载的影响。
Google 发布 MedGemma 1.5 4B,新增对 CT、MRI 和全切片病理等高维医学影像的支持,并同步推出医疗听写语音识别模型 MedASR。
推荐理由:原文给出 MedGemma 1.5 与 MedASR 的基准提升和开放下载入口,读者可据此判断医疗多模态模型的可用边界。
Google DeepMind 更新 Veo 3.1 Ingredients to Video,让基于参考图生成的视频更富表现力,并提升角色、背景与物体的一致性。
推荐理由:官方说明了 Ingredients to Video 在角色一致性与竖屏输出上的变化,可据此判断移动端短视频工作流会怎么变。
Zenken 在全公司范围部署 ChatGPT Enterprise,提升了销售业绩、缩短了准备时间并提高了提案成功率。AI 支持的工作流帮助这支精简团队实现更个性化、更有效的客户互动。