跳到正文

全部动态

今日 6 条
1月14日周三
1月13日周二
1月10日周六
  1. Berkeley AI Research29

    信息驱动的成像系统设计:Berkeley AI Research 提出基于互信息的成像系统评估框架

    Berkeley AI Research 提出一种基于互信息的成像系统评估与优化框架,可直接从含噪测量中估计信息量,预测系统性能。该方法在彩色摄影、射电天文、无透镜成像和显微镜四个领域验证有效,优化后的设计达到端到端方法水平,且内存和计算需求更低、无需任务专用解码器。相关成果发表于 NeurIPS 2025 论文。

1月9日周五
1月8日周四
1月7日周三
  1. OpenAI News60

    OpenAI 推出 ChatGPT Health

    OpenAI 推出 ChatGPT Health,这是一个独立的使用体验,可安全连接用户的健康数据与 App。该功能强调隐私保护,并采用由医生参与设计的方案。

    推荐理由:OpenAI 推出独立的健康使用场景,读者可了解它如何接入健康数据与 App 并处理隐私。

1月6日周二
  1. Hugging Face Blog62

    NVIDIA 发布 Cosmos Reason 2 推理视觉语言模型

    NVIDIA 发布面向物理 AI 的开源推理视觉语言模型 Cosmos Reason 2,提供 2B 和 8B 两种参数规模,并在 Physical AI Bench 与 Physical Reasoning 榜单上成为排名第一的开源模型。

    推荐理由:Cosmos Reason 2 把上下文从 16K 扩到 256K 并新增轨迹与 2D/3D 定位能力,可据此判断物理 AI 智能体的视频理解边界。

1月5日周一
1月2日周五
  1. OpenAI News20

    OpenAI Grove 第二期开放申请

    OpenAI Grove 第二期已开放申请,这是一个为期 5 周的创始人项目,面向从仅有想法到已有产品的任何阶段参与者。入选者可获得 5 万美元 API 额度、AI 工具早期访问权限以及 OpenAI 团队的实操指导。

12月24日周三
12月23日周二
  1. Hugging Face Blog50

    Hugging Face 推出 AprielGuard:面向现代 LLM 系统的 8B 安全护栏模型

    Hugging Face 发布 8B 参数安全护栏模型 AprielGuard,可检测 16 类安全风险及提示注入、越狱、思维链污染、记忆投毒、多智能体攻击等对抗攻击,并覆盖工具调用与推理轨迹等智能体工作流。模型提供推理与非推理两种模式,兼顾可解释分类与低延迟生产部署。训练数据由 Mixtral-8x7B 等合成生成,并借助 NVIDIA NeMo Curator 构建多轮对话攻击数据集。

12月22日周一
12月19日周五
12月18日周四
  1. OpenAI News68

    OpenAI 发布 GPT-5.2-Codex 编码模型

    OpenAI 发布 GPT-5.2-Codex,称其为自家最先进的编码模型。该模型主打长程推理、大规模代码转换和增强的网络安全能力。

    推荐理由:OpenAI 官方给出 GPT-5.2-Codex 的定位与三项能力方向,可据此了解其编码模型的最新迭代重点。

12月17日周三
  1. OpenAI News20

    OpenAI 推出面向新闻机构的 OpenAI Academy

    OpenAI 联合 American Journalism Project 和 The Lenfest Institute 推出 OpenAI Academy for News Organizations,帮助新闻编辑室有效使用 AI。该学习中心为记者、编辑和出版方提供培训、实用案例与负责任使用指南,支持其在报道和运营中采用 AI。

  2. OpenAI News62

    OpenAI 开放开发者向 ChatGPT 提交应用

    OpenAI 宣布开发者可以向 ChatGPT 提交应用,经审核通过后会在产品内新的应用目录中展示,便于用户发现。官方同时更新了工具、指南和 Apps SDK,帮助开发者构建把真实操作带入 ChatGPT 的对话原生体验。

    推荐理由:OpenAI 开放 ChatGPT 应用提交与审核入口,开发者可据此判断自家应用进入该生态的路径。

12月16日周二
  1. Google DeepMind60

    Google DeepMind 发布 Gemma Scope 2,为 Gemma 3 全系列提供开源可解释性工具

    Google DeepMind 发布 Gemma Scope 2,一套覆盖 Gemma 3 全系列(270M 到 27B 参数)的开源可解释性工具,结合稀疏自编码器(SAEs)和 transcoders 查看模型内部计算。

    推荐理由:Gemma Scope 2 覆盖 Gemma 3 全尺寸并新增跨层工具,读者可了解开源可解释性工具当前能审计哪些模型行为。

  2. Google Research62

    Google 为 STOC 2026 推出 Gemini 论文助手 PAT

    Google Research 为 STOC 2026 打造实验性 Paper Assistant Tool(PAT),基于 Gemini 2.5 Deep Think 的推理扩展方法,在投稿后 24 小时内给出结构化预审反馈。

    推荐理由:Google 披露 PAT 在 STOC 2026 的试用数据,读者可据此判断 AI 预审在数学证明类写作中的实际边界。

12月13日周六
  1. Google DeepMind71

    Google DeepMind 发布升级版 Gemini 2.5 Flash Native Audio,并推出实时语音翻译

    Google DeepMind 发布升级版 Gemini 2.5 Flash Native Audio,面向实时语音智能体,在函数调用、指令遵循和多轮对话三方面做了改进。

    推荐理由:官方给出 Gemini 2.5 Flash Native Audio 在函数调用、指令遵循和多轮对话上的具体提升数据,可据此判断语音智能体的可用性变化。

12月12日周五