跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

185条精选相关主题模型发布行业动态AI 编码

最新精选

第 61–80 条 · 共 185 条
5月27日周三
  1. Hugging Face Blog66

    Hugging Face 在 TRL 中实现增量权重同步,异步 RL 每步传输量降至 20-35MB

    Hugging Face 在 TRL 中落地了增量权重同步(Delta Weight Sync):只把两次 RL 优化步之间真正变化的 bf16 权重编码成稀疏 safetensors 文件,上传到 Hugging Face Bucket,再由 vLLM 拉取应用。

    推荐理由:TRL 的稀疏增量权重同步把异步 RL 每步传输量压到原来的百分之几,读者可据此判断跨集群训练的成本边界。

5月18日周一
  1. Google DeepMind60

    Google DeepMind 为 Project Genie 加入 Street View 实景锚定能力

    Google DeepMind 在实验性原型 Project Genie 中上线 Street View 实景锚定能力,用户可选取美国地点并叠加风格与角色描述,生成起始位置对应真实街景影像的交互世界。

    推荐理由:原文给出 Genie 接入 Street View 实景锚定的能力与开放范围,读者可据此判断世界模型在智能体与机器人训练上的落地路径。

5月17日周日
  1. Google DeepMind66

    Google 将 SynthID 与 C2PA 内容验证扩展到 Search、Gemini 和 Chrome

    Google 宣布把内容透明度与验证工具扩展到 Search、Gemini、Chrome、Pixel 和 Cloud。SynthID 已为超过 1000 亿张图片和视频、6 万年音频打上水印,Gemini 应用中的 SynthID 验证已被使用 5000 万次,该能力今日起进入 Search、未来几周进入 Chrome。

    推荐理由:原文列出 SynthID 与 C2PA 验证在 Search、Gemini、Chrome 的落地范围,可据此判断内容溯源工具的实际可用边界。

5月15日周五
  1. OpenAI News62

    OpenAI 在 ChatGPT 中推出个人财务功能

    OpenAI 在 ChatGPT 中推出个人财务功能,可连接账户、追踪支出与投资、管理订阅、制定预算并规划财务目标。原文未披露该功能的开放范围与上线时间。

    推荐理由:OpenAI 在 ChatGPT 内上线个人财务功能,读者可了解其账户连接与预算管理的能力边界。

5月6日周三
  1. Google DeepMind73

    Google DeepMind 公布 AlphaEvolve 一年进展:从 TPU 设计到商业客户落地

    Google DeepMind 回顾了 Gemini 驱动的编码智能体 AlphaEvolve 发布一年来的应用进展,称其已从试点成为 Google 基础设施的核心组件,用于优化下一代 TPU 设计和缓存替换策略。

    推荐理由:原文汇总了 AlphaEvolve 在基因组、电网、量子物理和商业客户中的落地数据,可据此判断编码智能体的跨领域适用范围。

4月28日周二
4月27日周一
  1. Mistral AI62

    Mistral AI 发布 Workflows 公开预览版

    Mistral AI 发布企业 AI 编排层 Workflows 公开预览版,提供持久化执行、可观测性和容错能力,ASML、ABANCA、CMA-CGM、France Travail、La Banque Postale、Moeve 等客户已用它自动化关键流程。

    推荐理由:原文给出 Workflows 的编排能力、部署模型与已落地客户案例,读者可据此判断企业级 AI 流程如何从概念验证走向生产。

4月23日周四
4月22日周三
  1. OpenAI News60

    OpenAI 在 ChatGPT 中推出工作区智能体

    OpenAI 在 ChatGPT 中推出工作区智能体(workspace agents),由 Codex 驱动,可自动执行复杂工作流并在云端运行。官方称其帮助团队跨工具安全地扩展工作。

    推荐理由:OpenAI 官方给出 ChatGPT 工作区智能体的定位与云端运行方式,读者可据此了解团队自动化的新入口。

4月21日周二
  1. OpenAI News62

    OpenAI 推出 ChatGPT Images 2.0

    OpenAI 发布 ChatGPT Images 2.0,改进了文字渲染、多语言支持和视觉推理能力。官方同时提到 Images 2.5 的新变化。

    推荐理由:官方给出 ChatGPT Images 2.0 在文字渲染、多语言和视觉推理上的改进方向,可据此判断图像生成能力的迭代重点。

4月16日周四
4月15日周三
3月29日周日
  1. Google DeepMind62

    Google DeepMind 为 AI 时代重新设计鼠标指针,Gemini 驱动的 AI 指针已进入 Chrome

    Google DeepMind 公布了一套 AI 指针的交互原则,让指针不仅知道指向什么,还能理解它对用户的意义,由 Gemini 驱动。团队提出四条原则:保持工作流不被打断、用指向加语音替代长提示词、支持“这个”“那个”式的自然简写、把像素转化为可操作实体。

    推荐理由:Google DeepMind 公开了 AI 指针的四条交互原则,并说明该能力已进入 Chrome 与 Googlebook,读者可据此判断浏览器内 AI 交互的走向。

3月18日周三
  1. Mistral AI62

    Mistral AI 推出 Forge,让企业用自有知识训练前沿模型

    Mistral AI 推出 Forge,一个让企业基于专有知识构建前沿级 AI 模型的系统,支持预训练、后训练和强化学习等阶段。Forge 支持 dense 与 MoE 两种架构,并可按需支持多模态输入,模型可在企业自有基础设施内训练和治理。

    推荐理由:原文给出了企业用自有数据训练前沿模型的分阶段能力与多架构支持,读者可据此判断自建模型的落地路径。

3月12日周四
  1. Google Research67

    Google 在 Flood Hub 上线城市山洪预报,提前 24 小时预警

    Google 宣布在 Flood Hub 上线城市山洪预报,借助新的 AI 方法可在城市地区提前最多 24 小时预测山洪风险。为弥补山洪缺乏地面实测数据的问题,Google 用 Groundsource 方法结合 Gemini 分析公开新闻报道,构建历史山洪事件数据集来训练和评估新模型。

    推荐理由:Google 把城市山洪预警接入 Flood Hub,读者可了解其用 Gemini 从新闻中提取训练数据的思路与全球覆盖取舍。

  2. Google Research60

    Google 推出 Groundsource,用 Gemini 将新闻报道转为灾害数据

    Google 推出 Groundsource,一种用 Gemini 从非结构化全球新闻中提取灾害数据的可扩展方法,并开放首个城市山洪数据集,包含 260 万条记录、覆盖 150 多个国家、时间跨度从 2000 年至今。

    推荐理由:原文给出了用 Gemini 从新闻抽取灾害数据的方法与验证结果,读者可据此判断 LLM 构建历史基准的可行边界。

3月11日周三
3月10日周二