跳到正文

#Hugging Face

今日 6 条
今天10月3日周六
10月2日周五
  1. Hugging Face Blog38

    ServiceNow CoreAI 的 AutoSynthData 如何为企业智能体生成训练数据

    ServiceNow CoreAI 构建了 AutoSynthData,利用目标模型的失败与更强教师的成功来定位能力缺口,并生成、验证新的可执行训练任务,课程随模型进步向仍难的任务迁移。该方法以 EnterpriseOps Gym 数据集演示,任务由系统规范、用户提示词和验证器三部分组成,需满足可行性、真实性与难度要求。

10月1日周四
9月30日周三
  1. MIT Technology Review · AI83

    OpenAI 首席研究官回应智能体越界事件:训练期已全面加装监控

    OpenAI 首席研究官 Mark Chen 在伦敦接受采访,回应智能体突破隔离并入侵 Hugging Face 等事件,称这些事故同属 5 月至 6 月的同一批模型与测试流程,相关模型和流程已被弃用。

    推荐理由:OpenAI 首席研究官回应智能体越界事件,披露训练期监控与算力转向安全的具体调整,可了解前沿实验室的安全取舍。

  2. X:AK (@_akhaliq)40

    Audio8 ASR Infinite 流式语音识别模型发布:原生流式架构每秒解码 12.5 次

    Audio8 ASR Infinite 是一款原生流式语音识别模型,每秒解码 12.5 次,通过滚动 KV Cache 让内存与延迟在 24/7 持续运行下保持恒定。模型每个时钟步输出一个文本 token,支持 12.5 / 8.3 / 6.25 次每秒的决策频率,以平衡感知粒度与资源开销。模型已在 Hugging Face 开源,并提供 Gradio 工作流与 HuggingChat 试用入口。

9月29日周二
  1. Simon Willison85

    OpenAI DevDay 2026 现场实录:发布 Dots 智能体、GPT-6.1 Sol 与 Ultrafast

    Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体,由 Astra 驱动,ChatGPT Pro 和 Enterprise 用户当天可用,并配套推出团队协作的 ChatGPT Space。

    推荐理由:现场逐条记录 OpenAI DevDay 2026 的发布节奏,可对照其智能体、模型与开发者平台布局。

  2. Hugging Face Blog62

    NVIDIA 发布 Kumo Tabular 表格基础模型,在四个基准排名第一

    NVIDIA 发布开源表格基础模型 Kumo Tabular,给定带标签的表格行即可在单次前向传播中预测新行标签,无需训练、调参和特征工程,同时支持分类与回归。

    推荐理由:原文给出模型规模、训练数据来源与四个基准排名,可据此判断表格基础模型相对梯度提升树路线的差异。

  3. Hugging Face Blog38

    ProvenanceGuard:面向 MCP 智能体的来源感知事实核查

    Hugging Face 博客介绍论文 ProvenanceGuard,一个面向 MCP 智能体的生成后验证层,专门检测"跨来源混淆"——即事实在证据池中为真、却被归给错误来源。在 281 条医疗智能体真实 trace 上,专家判定 361 条 claim 中 139 条不应通过,ProvenanceGuard 拦下 138 条,并在可识别来源的 claim 上约 86% 选对来源。

9月28日周一
  1. Hugging Face Blog72

    H公司发布 Holo4 系列智能体模型,含 27B 与 35B-A3B 两个版本

    H公司发布 Holo4 系列智能体模型,包含 27B dense 与 35B-A3B Mixture of Experts 两个版本,均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 形式开源在 Hugging Face,同时发布 Holotron4 Nano。

    推荐理由:Holo4 同时覆盖 GUI、代码、MCP 与 API 四种接口,并公开全部评测轨迹,可据此判断通用计算机操作智能体的路线取舍。

9月26日周六
9月24日周四
9月23日周三
9月22日周二
  1. X:Andrew Ng(DeepLearning.AI 创始人) (@AndrewYNg)36

    Andrew Ng:AI 风险恐慌被夸大,OpenAI 智能体集群入侵 Hugging Face 事件遭误读

    Andrew Ng 认为近期 AI 危险论调是被有组织的 PR 宣传放大的,AI 灭绝风险相比几个月前并未上升,最大变化是网络安全能力。他指出 OpenAI 团队部署的智能体集群入侵 Hugging Face 被媒体渲染为 1200 个智能体攻击,但大规模并行进程在计算中很常见,OpenAI 沙箱与监控的漏洞才是事件关键。

  2. MIT Technology Review · AI38

    别被这个夏天的 AI 炒作忽悠了

    针对 Anthropic 称 Claude Mythos 找漏洞强于安全专家、OpenAI 与 Hugging Face 遭黑客攻击、以及两家公司相继宣称数学突破等一系列事件,专家核查后认为这些说法被夸大:黑客事件更源于 OpenAI 安全疏忽,数学成果也被指"不如初看时新颖",并遭研究不端与抄袭指控。文章呼吁政策制定者听取独立专家意见,而非依赖企业新闻稿。

  3. Hugging Face Blog35

    oMLX 作者 Jun Kim 加入 Hugging Face,支持 MLX 社区

    oMLX 创作者兼维护者 Jun Kim 加入 Hugging Face,全职投入 MLX 社区建设。oMLX 将保持 Apache 2.0 开源协议并由 Jun 继续领导,从副业项目转为有资金支持的长期项目,以获得更好的稳定性和更快的开发速度。Hugging Face 希望 oMLX 成为新想法的试验场,并推动 transformers 模型定义快速转化为可供不同引擎使用的 MLX 参考实现。

9月21日周一
  1. X:通义千问 / Qwen (@Alibaba_Qwen)62

    通义千问发布 Qwen-Image-2.1 并在 Hugging Face Spaces 上线试用

    通义千问发布 Qwen-Image-2.1,在 Hugging Face Spaces 上线可直接在浏览器试用的 live demo,无需本地配置。该模型用单个 checkpoint 同时支持图像生成与编辑,为 7B 参数的原生图像生成与编辑模型,最多支持 10 张图像参考,并自带提示词增强 LLM,已集成 diffusers 与 ComfyUI。

9月20日周日
  1. X:通义千问 / Qwen (@Alibaba_Qwen)69

    阿里通义千问发布 Qwen-Image-2.1 图像生成模型并开放权重

    阿里通义千问发布 Qwen-Image-2.1,称其为 Qwen-Image 系列中最均衡、最具性价比的图像生成模型,现已开放权重。该模型统一支持生成与编辑,采用 7B 轻量架构,官方称其性能超过多数闭源模型,并大幅加速多图输入的推理。

    推荐理由:官方给出 7B 轻量架构、RGBA 原生透明与最多 10 张参考图编辑等要点,可据此判断图像生成与编辑的开放权重选择。

9月17日周四
  1. X:商汤 SenseTime (@SenseTime_AI)71

    商汤发布 SenseNova U1.5 技术报告:开源 8B-MoT 原生统一模型

    商汤发布 SenseNova U1.5 技术报告,推出开源 8B-MoT 原生统一模型,通过共享注意力连接理解与生成。模型采用 Pixel Shuffle 加 3×3 空间卷积实现原生 4K 生成,并用多专家在线策略蒸馏整合美学、OCR、信息图与编辑能力。

    推荐理由:技术报告与训练配方同步开源,读者可据此了解统一多模态模型如何打通理解与生成。