跳到正文

#Hugging Face

今日 0 条
12月23日周二
  1. Hugging Face Blog50

    Hugging Face 推出 AprielGuard:面向现代 LLM 系统的 8B 安全护栏模型

    Hugging Face 发布 8B 参数安全护栏模型 AprielGuard,可检测 16 类安全风险及提示注入、越狱、思维链污染、记忆投毒、多智能体攻击等对抗攻击,并覆盖工具调用与推理轨迹等智能体工作流。模型提供推理与非推理两种模式,兼顾可解释分类与低延迟生产部署。训练数据由 Mixtral-8x7B 等合成生成,并借助 NVIDIA NeMo Curator 构建多轮对话攻击数据集。

12月18日周四
12月17日周三
12月16日周二
12月11日周四
12月5日周五
12月4日周四
12月1日周一
11月25日周二
  1. Hugging Face Blog29

    从第一性原理理解 continuous batching

    Hugging Face 发布博客,从注意力机制与 KV 缓存出发,推导出 continuous batching 这一推理优化技术。该方法通过并行处理多个对话、完成即换出,来最大化高负载场景下的吞吐量。文中指出注意力是 token 间唯一交互之处,其计算量随序列长度呈平方增长。

  2. Hugging Face Blog41

    Tavily 如何打造达到 SOTA 的 Deep Research 智能体

    Tavily 分享了构建 SOTA 深度研究智能体的经验:七个月前其第一版架构因假设过于复杂,在下一代模型到来时成为瓶颈,团队被迫推倒重建。新方案简化编排逻辑、强调自主性,并借助 Tavily Advanced Search 在工具侧完成上下文工程,只返回最相关内容块以降低模型幻觉与延迟。团队还提出将工具输出蒸馏为反思、仅在生成最终交付物时注入原始信息,以模拟人类研究方式管理上下文窗口。

11月21日周五
  1. Hugging Face Blog51

    Hugging Face TRL 集成 RapidFire AI,微调实验提速最高 20 倍

    Hugging Face TRL 正式集成 RapidFire AI,用户可并发运行多个微调与后训练配置并近乎实时比较结果。RapidFire AI 通过自适应分块调度在单张 GPU 上同时跑多个配置,官方基准显示达到同等最佳训练 loss 的时间相比顺序比较提速 15 至 20 倍,并支持 SFT、DPO、GRPO 的 drop-in 配置与 MLflow 仪表盘上的停止、克隆、修改等操作。

11月20日周四
11月19日周三
  1. Hugging Face Blog60

    ServiceNow 发布 Apriel-H1:将 15B 推理模型蒸馏为 Mamba 混合架构,吞吐提升 2.1 倍

    ServiceNow 的 SLAM Lab 发布 Apriel-H1,把 15B 推理模型改造成 Mamba 混合架构,旗舰版 Apriel-H1-15b-Thinker-SFT 实现 2.1 倍吞吐且质量损失很小,MATH500 从 0.90 升到 0.92、MTBench 从 8.30 升到 8.58,GSM8k、GPQA、AIME24 略有下降。

    推荐理由:ServiceNow 公开了把 15B 推理模型蒸馏成 Mamba 混合架构的完整流程与七个 checkpoint,可看到效率与质量的取舍曲线。

11月17日周一
11月14日周五
11月13日周四
10月29日周三
  1. Hugging Face Blog62

    Hugging Face 分析全球算力格局变迁:中国国产芯片与开源模型的双向推动

    Hugging Face 发布分析文章,指出中国开源权重模型的推理已开始由华为昇腾、寒武纪等国产芯片承载,部分模型开始用国产芯片训练。文章认为美国出口管制与中国芯片产能提速高度相关,芯片稀缺也促使 DeepSeek 的 MLA、GRPO 等算力效率创新走向开源。

    推荐理由:梳理中国算力从被限制到自建全栈的路径,帮助读者理解开源模型与国产芯片如何互相推动。

10月28日周二
  1. Hugging Face Blog40

    Hugging Face 提出“语音同意门”:让语音克隆必须先获得本人明确同意

    Hugging Face 提出“语音同意门”机制,让语音克隆模型只有在说话人明确说出同意语句后才会启动。该方案由语言模型生成约 20 词的同意句与中性语音多样性句,经 ASR 识别同意内容后,再由 TTS 完成克隆,并建议同意音频直接来自麦克风而非上传文件。团队已提供示例 Space 和配套代码。

10月27日周一
  1. Hugging Face Blog60

    huggingface_hub v1.0 发布:迁移到 httpx 与 hf_xet,CLI 全面重写

    Hugging Face 发布 huggingface_hub v1.0,这是该库五年来的首个大版本,带来多项破坏性变更。主要变化包括底层从 requests 迁移到 httpx、文件传输全面改用 hf_xet 取代 hf_transfer,以及用基于 Typer 的 hf CLI 替换已弃用的 huggingface-cli。

    推荐理由:官方梳理了 huggingface_hub v1.0 的破坏性变更与迁移路径,可据此评估自家依赖库的升级成本。

10月24日周五
  1. Hugging Face Blog60

    LeRobot v0.4.0 发布:数据集 v3.0、PI0.5 与 GR00T N1.5 及硬件插件系统

    Hugging Face 发布 LeRobot v0.4.0,带来 LeRobotDataset v3.0 分块 episode 格式与流式加载,支持 OXE 级别(> 400GB)数据集,并提供 lerobot-edit-dataset CLI 用于删除、拆分、合并数据集。

    推荐理由:原文列出数据集、仿真环境、多 GPU 训练与硬件插件等具体变化,读者可据此判断开源机器人学习工具链的可用性。

10月23日周四
  1. Hugging Face Blog71

    Meta 与 Hugging Face 联合推出 OpenEnv Hub 智能体环境共享平台

    Meta 与 Hugging Face 合作推出 OpenEnv Hub,一个面向智能体环境的开放共享社区平台,环境定义智能体完成任务所需的工具、API、凭证和执行上下文。

    推荐理由:Meta 与 Hugging Face 联合推出智能体环境共享 Hub,并同步开放 0.1 规范 RFC,读者可据此了解智能体训练与部署的标准化路径。

10月22日周三
  1. Hugging Face Blog47

    Hugging Face 与 VirusTotal 合作加强 AI 安全

    Hugging Face 宣布与威胁情报平台 VirusTotal 合作,即日起对 Hub 上 220 万+ 公开模型和数据集仓库进行持续扫描。用户访问仓库或文件页面时,Hub 会自动将文件哈希与 VirusTotal 威胁情报库比对,返回检测数量、已知恶意关联等元数据,且不共享原始文件内容。组织可将 VirusTotal 检查集成到 CI/CD 或部署流程中,在下载或集成文件前识别恶意资产。

10月21日周二
  1. Hugging Face Blog57

    Hugging Face AI Sheets 新增视觉支持,可在表格中提取、生成和编辑图像

    Hugging Face 为开源工具 AI Sheets 发布重大更新,新增视觉支持,可在表格中查看、分析图像并提取信息、生成和编辑图像,无需写代码。图像列支持提取文字、图像问答、目标检测、上色、添加文字等操作,文字列支持摘要、关键词提取和翻译,每个 AI 动作由提示词和模型定义,底层通过 Inference Providers 调用数千个开放模型。

10月17日周五
10月16日周四
10月15日周三
10月14日周二
10月7日周二
  1. Hugging Face Blog38

    Hugging Face 推出 BigCodeArena:通过代码执行端到端评判代码生成

    Hugging Face 发布 BigCodeArena,这是首个通过实际执行来评估代码生成模型的人类参与平台,支持 10 种语言和 8 种执行环境,可实时运行模型生成的代码并投票对比。平台自 2025 年 2 月上线以来已收集超 14,000 次对话、500 多名用户和 4,700+ 偏好投票,o3-mini 与 o1-mini 在 Elo 排名中持续领先。

10月2日周四