Johns Hopkins 与 Carnegie Mellon University 的新论文显示,一个 4B 小模型通过学习失败报告来改写 agent 的 harness 代码,可迁移到新任务。
#端侧
#端侧
rohanpaul_ai@rohanpaul_aiAI 评分
Google Research精选AI 评分Google 用冻结多 Token 预测加速 Pixel 上的 Gemini Nano 模型
Google Research 提出一种将多 Token 预测(MTP)头接到已冻结的 Gemini Nano v3 模型上的架构,已在 Pixel 9 和 10 系列上线,用于 AI 通知摘要和 Proofread 等功能。
推荐理由:原文披露了冻结主干加 MTP 头的端侧推理方案,读者可了解手机端提速与省内存的具体做法。
Google Research精选AI 评分Google 研究用手机前置摄像头实现被动心率监测
Google Research 在 Nature 发表 PHRM 研究系统,利用手机前置摄像头在面部解锁后拍摄 8 秒面部视频,通过深度学习估算心率,与心电图相比 MAPE 低于 10%,覆盖所有肤色。
推荐理由:Google 用 35 万段手机视频训练 rPPG 模型,并公开迄今最大规模数据集,读者可了解被动心率监测的可行边界。
Google ResearchAI 评分Google 如何用零信任聚合实现隐私分析
Google 提出一种零信任隐私分析方案,将一次性提交的新型密码学聚合协议与 TEE 结合,使设备无需多轮在线即可安全上报数据。该设计保证 Google 只能获得群体匿名聚合结果,原始数据即使在硬件保护范围内也不会被解密或重建,TEE 证明则向参与者验证协议按公开代码正确执行。
Google ResearchAI 评分Google 研究:小模型通过分解式方法实现更优用户意图提取
Google Research 在 EMNLP 2025 发表的论文提出一种分解式方法,将用户意图理解拆为两步:先用小型多模态 LLM 逐屏总结交互,再从摘要序列中提取意图。在移动端和网页轨迹上,该方法优于 CoT 提示和端到端微调,Gemini 1.5 Flash 8B 配合该方法的意图提取效果可与 Gemini 1.5 Pro 相当,成本与速度仅为后者一小部分。