跳到正文

#Google

今日 1 条
8月6日周四
  1. Google DeepMind77

    Google DeepMind 的 WeatherNext 气旋预报精度提升,并开源模型

    Google DeepMind 在 Nature 发表论文,称 WeatherNext AI 模型在预测气旋路径、强度和风场结构上达到 SOTA,平均多出一天(24 小时)的预报提前量,三天预报精度相当于此前模型的两天水平。

    推荐理由:Google DeepMind 在 Nature 论文中给出气旋路径与强度预报的精度提升,并同步开源模型权重,读者可据此了解 AI 天气预报的当前进展与可用入口。

7月31日周五
7月30日周四
  1. Google DeepMind49

    Google 在 Flow Music 发布 Lyria 3.5,提升音乐性、歌词、人声与创作控制

    Google DeepMind 在 Google Flow Music 中推出新一代音乐生成模型 Lyria 3.5,在音乐性、歌词和人声质量上均有明显提升。新版本可生成更复杂自然的旋律结构、提示词遵循度和结构感知更强的歌词,以及更具情感表现力和发音更准确的人声,并支持更便捷地控制输出节奏与时长。该模型即日起在 Flow Music 上线。

7月28日周二
7月23日周四
7月22日周三
7月21日周二
7月17日周五
7月16日周四
7月13日周一
7月9日周四
7月8日周三
7月3日周五
  1. Google DeepMind32

    Google DeepMind 与 A24 宣布首个研究型合作伙伴关系

    Google DeepMind 与 A24 宣布达成首个聚焦研究的合作伙伴关系,双方将围绕多个项目展开长期研发协作,让 A24 及其电影人参与塑造新技术。Google 同时已对 A24 进行投资。该合作初期聚焦弥合前沿技术与下一代娱乐之间的差距,具体目标与技术产出将随时间演进。

7月1日周三
  1. Google DeepMind78

    Google DeepMind 发布 Nano Banana 2 Lite 与 Gemini Omni Flash

    Google DeepMind 发布 Nano Banana 2 Lite(gemini-3.1-flash-lite-image)和 Gemini Omni Flash(gemini-omni-flash-preview)两款模型,前者是 Nano Banana 家族中速度最快、成本最低的图像模型,后者支持高质量视频生成与对话式编辑。

    推荐理由:Google DeepMind 同时放出图像与视频两款新模型,并给出延迟、单价和可用入口,便于开发者评估替换与串联方案。

6月30日周二
  1. Google Research71

    Google 发布 TabFM:面向表格数据的零样本基础模型

    Google 发布 TabFM,一个面向表格数据分类与回归的零样本基础模型,将表格预测重构为上下文学习问题,无需手动训练、超参数调优和特征工程,单次前向传播即可对未见过的表格生成预测。

    推荐理由:原文给出 TabFM 的零样本表格预测机制与 TabArena 基准表现,读者可据此判断它能否替代传统树模型工作流。

6月27日周六
6月25日周四
  1. Google Research27

    Google 用线性弹性缓存优化云成本,Spanner 内存用量降 15.5%

    Google Research 提出线性弹性缓存,将页面淘汰建模为滑雪租赁问题,用轻量机器学习动态调整缓存大小,在 Spanner 生产环境实测内存用量降低 15.5%、缓存未命中仅增加 5.5%、TCO 降低约 5%。该方案用浅层决策树为每个页面预测 TTL,缓存写满时仍由 LRU 兜底,并在多个公开缓存 trace 上与 GDSF 基线对比验证。

6月23日周二
6月17日周三
  1. Hugging Face Blog62

    Hugging Face 发布 Agentic Resource Discovery 参考实现 Discover Tool

    Hugging Face 发布 Agentic Resource Discovery(ARD)规范的参考实现 Discover Tool,让智能体在运行时按自然语言搜索能力,而不再依赖预先安装。

    推荐理由:Hugging Face 给出 ARD 规范的参考实现与 CLI、REST、MCP 三种调用入口,可据此判断智能体能力发现如何从预装目录转向运行时检索。

6月16日周二
6月13日周六
6月11日周四
6月10日周三
6月9日周二
  1. Google DeepMind80

    Google DeepMind 发布 Gemini 3.5 Live Translate 实时语音翻译模型

    Google DeepMind 发布 Gemini 3.5 Live Translate,这是一款音频模型,可自动检测 70+ 语言并生成保留说话人语调、节奏和音高的近实时语音到语音翻译,且持续输出而非等说话人说完再翻译,全程仅落后几秒。

    推荐理由:Gemini 3.5 Live Translate 支持 70+ 语言连续语音翻译,并同步开放 API 与 Google 产品入口,可据此判断实时翻译的落地方式。

6月8日周一
  1. Google DeepMind62

    Google DeepMind 在塞拉利昂开展 AI 学习试验,数学成绩提升 0.258 个标准差

    Google DeepMind 公布在塞拉利昂开展的预注册试验结果,使用 Guided Learning 的学生数学成绩比对照组提升 0.258 个标准差,约相当于八周内取得 1.2 至 1.7 年的常规学习进度。

    推荐理由:原文给出塞拉利昂预注册试验的量化结果与交互数据,读者可据此了解AI辅助教学的实际效果与局限。

6月5日周五
  1. Google Research60

    Google 在 Gemini Enterprise Agent Platform 上线 Agentic RAG 版跨语料检索

    Google 在 Gemini Enterprise Agent Platform 上推出由 Agentic RAG 驱动的跨语料检索公开预览版,通过规划、改写、路由与充分上下文智能体迭代检索多源数据。官方称相比标准 RAG,该框架在事实性数据集上准确率最高提升 34%;在跨语料设置下从 4 个候选语料中正确路由并答对 90.1% 的问题,单语料与跨语料版本延迟差异平均在 3% 以内。

    推荐理由:原文给出多智能体 RAG 的完整流程与跨语料评测数据,读者可据此判断它在多源检索场景下的可用性。

  2. Google Research67

    Google 研究用手机前置摄像头实现被动心率监测

    Google Research 在 Nature 发表 PHRM 研究系统,利用手机前置摄像头在面部解锁后拍摄 8 秒面部视频,通过深度学习估算心率,与心电图相比 MAPE 低于 10%,覆盖所有肤色。

    推荐理由:Google 用 35 万段手机视频训练 rPPG 模型,并公开迄今最大规模数据集,读者可了解被动心率监测的可行边界。