跳到正文

#开源生态

今日 2 条
3月9日周一
  1. Hugging Face Blog62

    LeRobot v0.5.0 发布:支持 Unitree G1 人形机器人并新增六种策略

    LeRobot v0.5.0 发布,自 v0.4.0 以来合并 200 多个 PR、新增 50 多位贡献者,首次加入 Unitree G1 人形机器人支持,涵盖运动、操作、遥操作与全身控制。

    推荐理由:从人形机器人支持到策略库与数据管线提速,读者可据此判断开源机器人栈当前覆盖的硬件与训练能力。

3月7日周六
3月4日周三
2月26日周四
  1. Hugging Face Blog52

    Hugging Face 详解 transformers 中的 MoE 支持

    Hugging Face 发文介绍 transformers 库如何为 MoE 模型重构支持,涵盖权重加载、专家后端、专家并行与训练四部分。权重加载引入 WeightConverter 与惰性物化,将 256 个独立专家张量打包为单个连续张量;在 Qwen1.5-110B-Chat 上,v5 异步加载耗时 20.71s,v4 为 66.24s,张量并行下为 10.1s。

2月20日周五
2月13日周五
  1. Hugging Face Blog62

    Hugging Face 发布 CUDA 内核 Agent Skill,Claude 与 Codex 为 LTX-Video 和 Qwen3-8B 生成内核

    Hugging Face 发布 cuda-kernels Agent Skill,让 Claude、Codex 等编码智能体为 diffusers 和 transformers 项目编写生产级 CUDA 内核,并生成 PyTorch 绑定与基准脚本。

    推荐理由:原文给出可安装的 CUDA 内核技能与完整基准数据,读者可据此判断智能体写内核的可行边界。

2月6日周五
2月5日周四
2月4日周三
2月3日周二
1月29日周四
  1. Hugging Face Blog62

    Gradio 团队推出开源 Python 库 Daggr,用代码串联 AI 工作流并自动生成可视化画布

    Gradio 团队发布开源 Python 库 Daggr,用于把 Gradio 应用、ML 模型和自定义函数串联成 AI 工作流,并自动生成可视化画布。它支持检查任意节点输出、修改输入并单独重跑某一步,还提供状态持久化和 sheets 多工作区,安装只需 Python 3.10 以上并执行 pip install daggr。

    推荐理由:原文给出代码优先的编排方式和可视化画布,读者可据此判断它是否适合替代现有调试脚本。

1月28日周三
  1. Hugging Face Blog62

    Hugging Face 发布 upskill:用 Claude 生成 CUDA kernel 技能并教给开源模型

    Hugging Face 发布新工具 upskill,可用大模型生成并评测 agent skill,再交给更小或本地模型使用。文章以用 Claude Opus 4.5 编写 diffusers 模型 CUDA kernel 为例,upskill 会基于 agent trace 生成技能和测试用例,并对比有无技能时的准确率与 token 消耗。

    推荐理由:原文给出用大模型生成并评测 agent skill 再迁移到小模型的完整流程,可复用到其他专业任务。

1月27日周二
  1. Hugging Face Blog38

    解锁 GPT-OSS 的智能体 RL 训练:一次实践复盘

    Hugging Face 博客复盘了用 verl 框架对 GPT-OSS 进行智能体强化学习训练时遇到的问题与修复。团队发现 GPT-OSS-20B 训练初期出现 KL 散度和熵爆炸、奖励不升,根因是 MoE 架构下双前向传播导致新旧 log-prob 不一致,使 PPO 的 importance sampling ratio 偏离 1;修复后该方案同样适用于 GPT-OSS-120B。

1月22日周四
  1. Mistral AI37

    堆内存会说谎:排查 vLLM 内存泄漏

    Mistral AI 团队在 vLLM 上排查一起内存泄漏,问题只在 Mistral Medium 3.1、开启图编译的 Prefill/Decode 分离部署中出现,系统内存以每分钟 400 MB 线性增长,数小时后触发 out of memory。Memray、Guppy 3 均未发现泄漏,Heaptrack 显示堆内存稳定但峰值 RSS 存在差异,说明泄漏发生在堆之外。

1月20日周二
1月6日周二
  1. Hugging Face Blog62

    NVIDIA 发布 Cosmos Reason 2 推理视觉语言模型

    NVIDIA 发布面向物理 AI 的开源推理视觉语言模型 Cosmos Reason 2,提供 2B 和 8B 两种参数规模,并在 Physical AI Bench 与 Physical Reasoning 榜单上成为排名第一的开源模型。

    推荐理由:Cosmos Reason 2 把上下文从 16K 扩到 256K 并新增轨迹与 2D/3D 定位能力,可据此判断物理 AI 智能体的视频理解边界。

1月5日周一
12月18日周四
12月17日周三
12月16日周二
12月12日周五
12月11日周四
12月9日周二
  1. Mistral AI78

    Mistral 发布 Devstral 2 编码模型与 Mistral Vibe CLI

    Mistral AI 发布新一代编码模型家族 Devstral 2,包含 123B 的 Devstral 2 和 24B 的 Devstral Small 2,两者均为开源模型,分别采用修改版 MIT 和 Apache 2.0 许可。

    推荐理由:官方给出两款开源编码模型的参数、许可与 SWE-bench 成绩,并附与闭源模型的对比,便于判断开源编码模型的当前水位。

12月3日周三
12月1日周一
11月25日周二
11月21日周五
  1. Hugging Face Blog51

    Hugging Face TRL 集成 RapidFire AI,微调实验提速最高 20 倍

    Hugging Face TRL 正式集成 RapidFire AI,用户可并发运行多个微调与后训练配置并近乎实时比较结果。RapidFire AI 通过自适应分块调度在单张 GPU 上同时跑多个配置,官方基准显示达到同等最佳训练 loss 的时间相比顺序比较提速 15 至 20 倍,并支持 SFT、DPO、GRPO 的 drop-in 配置与 MLflow 仪表盘上的停止、克隆、修改等操作。

11月20日周四
11月19日周三
  1. Mistral AI38

    Mistral AI 与 SAP、Helsing 达成合作,推进德国主权 AI 布局

    Mistral AI 宣布与 SAP 建立多年合作,为德国和欧洲提供完全主权的 AI 技术栈,将其模型集成进 SAP 的 AI Foundation,并联合开发面向复杂行业与政府机构的定制方案。同时与 Helsing 合作加速面向国防与安全应用的视觉-语言-动作模型研发。Mistral AI 还将大幅扩充德国本地团队,并于未来数月内在德国开设办公室。

  2. Google DeepMind26

    Google DeepMind 在新加坡开设新研究实验室,扩展亚太布局

    Google DeepMind 在新加坡开设新研究实验室,聚焦推进 Gemini 核心能力与亚太语言文化包容性研究,其亚太团队过去一年规模已翻倍以上。新实验室将与当地政府、企业和学术机构合作,此前已与 AI Singapore 推出东南亚语言开放数据平台 Project Aquarium,并支持基于 Gemma 3 多模态能力构建的 SEA-LION v4 发布。

11月17日周一
11月14日周五