跳到正文

全部动态

今日 5 条
8月17日周三
8月12日周五
8月11日周四
8月10日周三
  1. Hugging Face Blog22

    如何训练和微调 Sentence Transformers 模型

    Hugging Face 发布教程,讲解如何从零构建或微调 Sentence Transformers 模型。模型由预训练 Transformer(如 distilroberta-base)加池化层组成,可将变长文本映射为固定长度嵌入向量;相比直接用 BERT,语义搜索 1 万句的耗时从约 65 小时降至约 5 秒。教程还介绍了四种数据集格式与对应损失函数的选择。

8月5日周五
8月3日周三
  1. Hugging Face Blog40

    Hugging Face 推出 Private Hub:面向企业的机器学习协作平台

    Hugging Face 发布 Private Hub(PH),将模型、数据集、Spaces 等 ML 工具整合到统一平台,支持企业在安全合规环境下协作开发。Hugging Face Hub 现有超 60K 模型、6K 数据集和 6K 演示应用,模型覆盖 180 种语言、支持最多 25 个 ML 库。约 90% 的机器学习模型从未进入生产环境,PH 旨在加速从研究到生产的全流程。

8月2日周二
  1. Hugging Face Blog26

    Nyströmformer:用 Nyström 方法以线性时间和内存近似自注意力

    Nyströmformer 通过 Nyström 方法近似标准自注意力,将时间和内存复杂度从 O(n²) 降至 O(n)。它不直接对 softmax 矩阵采样,而是从 query 和 key 中用分段均值构造 landmark,仅需 32 或 64 个 landmark 即可在 n=4096 或 8192 的长序列上取得与标准自注意力及其他高效注意力机制相当的性能。

8月1日周一
  1. Hugging Face Blog12

    Hugging Face 就美国国家 AI 研究资源(NAIRR)中期报告提交建议

    Hugging Face 于 2022 年 6 月就美国国家 AI 研究资源(NAIRR)中期报告提交反馈,建议任命技术与伦理专家担任顾问、制定模型与数据文档标准、为非技术专家提供低代码或无代码工具,并推动开源与开放科学的高风险滥用监测。其回应还建议投入法律专业能力制定负责任 AI 许可证,并以多语言资源支持多元研究者视角,BigScience 研究工坊被列为范例。

7月28日周四
7月27日周三
7月25日周一
7月22日周五
  1. Hugging Face Blog22

    Hugging Face 深度强化学习课程:Advantage Actor Critic (A2C)

    Hugging Face 深度强化学习课程 Unit 7 讲解 Advantage Actor Critic(A2C),一种结合基于策略与基于价值方法的混合架构,通过 Actor 控制智能体行为、Critic 评估动作好坏来降低 Reinforce 中蒙特卡洛采样带来的高方差。课程使用 Stable-Baselines3 在 PyBullet 机器人环境中训练双足步行者和蜘蛛两个智能体行走。

7月20日周三
  1. OpenAI News83

    OpenAI 将 DALL·E 开放测试版,邀请 100 万候补用户

    OpenAI 宣布 DALL·E 进入测试版,将在未来几周从候补名单中邀请 100 万人使用。用户可用每月重置的免费额度生成图像,也可按 115 次生成一档、15 美元的价格购买额外额度。

    推荐理由:原文给出 DALL·E 测试版开放规模与免费额度、付费增量价格,便于读者了解早期图像生成产品的开放方式。

7月18日周一
7月16日周六
  1. Hugging Face Blog30

    如何用对抗数据动态训练你的模型

    Hugging Face 博客介绍动态对抗数据收集(DADC):让用户在与模型交互中构造能骗过模型的样本,再将这些对抗样本用于训练,多轮重复以提升鲁棒性。教程以 MNIST 手写数字识别为例,用 🤗 Spaces 搭建交互 demo,模型训练 20 个 epoch 后在测试集上达到 89% 准确率,并通过 flag 机制把对抗样本存入数据集再训练。

7月14日周四
7月13日周三
  1. Hugging Face Blog30

    如何用 Sentence Transformers 构建歌单生成器

    用 Sentence Transformers 的语义搜索搭建歌单生成器:将歌词按段落切块并嵌入,以 msmarco-MiniLM-L-6-v3 生成提示词嵌入,检索最相近的段落,top_k=20 时通常能得到至少 9 首不同歌曲。整个多步 Gradio 应用基于 Blocks API 构建并托管在 Hugging Face Spaces,歌词嵌入已发布在 Hugging Face Hub 上。

7月12日周二
  1. Hugging Face Blog78

    Hugging Face 发布 176B 参数开放多语言模型 BLOOM

    Hugging Face 发布 BLOOM,一个 176B 参数的多语言大语言模型,可生成 46 种自然语言和 13 种编程语言的文本。该模型由 70 多个国家、250 多家机构的 1000 多名研究者协作完成,在法国 Jean Zay 超算上训练 117 天,并首次公开训练中间检查点和优化器状态。

    推荐理由:BLOOM 以 176B 参数覆盖 46 种自然语言,并公开训练中间检查点,可据此了解开放大模型的训练与复现路径。

7月7日周四
6月30日周四
6月29日周三
  1. Hugging Face Blog22

    如何用 Sentence Transformers 开启你的第一个机器学习项目

    Hugging Face 发布入门指南,以 Sentence Transformers 为例讲解如何从零启动第一个 ML 项目。该库可将句子、段落和图像转为嵌入向量,并通过 util.cos_sim 计算余弦相似度,已在 GitHub 收获近 8,000 stars,超过 3,000 个项目依赖它。文中还给出选题方法:先梳理工具能力,再从 Hugging Face Hub 等渠道寻找数据。

6月28日周二
  1. Hugging Face Blog62

    Hugging Face 发布 Evaluation on the Hub,无需写代码即可评测模型

    Hugging Face 推出 Evaluation on the Hub,由 AutoTrain 驱动,用户无需写一行代码即可在 Hub 上用任意数据集和指标评测任意模型。评测结果会以 Pull Request 形式写入模型卡元数据,并可在数据集页面的榜单中对比不同模型表现。官方已用该工具评测了数百个模型,并给出文本分类、命名实体识别和文本摘要等可直接试用的数据集。

    推荐理由:原文说明了无需写代码即可在 Hub 上评测任意模型与数据集,并给出配置流程和榜单入口。

6月23日周四
  1. OpenAI News70

    OpenAI 用视频预训练让神经网络学会玩 Minecraft

    OpenAI 提出 Video PreTraining(VPT)方法,在大量无标注的人类玩 Minecraft 视频数据上训练神经网络,仅使用少量承包商标注数据。经微调后,模型能学会制作钻石工具,这一任务通常需要熟练人类花费 20 多分钟、约 24000 次操作。模型使用键盘按键和鼠标移动这类原生人类交互接口,通用性较强,是迈向通用计算机使用智能体的一步。

    推荐理由:OpenAI 用少量标注数据加海量无标注视频训练出能玩 Minecraft 的模型,可了解视频预训练这条路径的早期做法。

  2. Hugging Face Blog36

    Hugging Face 教程:如何用 Embeddings 快速搭建 FAQ 语义搜索

    Hugging Face 发布入门教程,演示如何用 Sentence Transformers 的 all-MiniLM-L6-v2 模型和 Inference API 为美国 Medicare FAQ 数据集生成嵌入向量,并上传至 Hub 免费托管。用户查询经嵌入后与数据集比对,即可找出语义最相似的 FAQ 条目。首次调用 API 约需 20 秒下载模型,后续请求会明显加快。

6月22日周三
6月15日周三
  1. Hugging Face Blog40

    Intel 与 Hugging Face 合作,通过 Optimum Intel 加速 Transformer 硬件

    Intel 正式加入 Hugging Face 硬件合作伙伴计划,双方将基于开源库 Optimum 共同构建面向 Transformer 训练、微调与推理的硬件加速方案。Optimum Intel 构建在 Intel Neural Compressor 之上,支持量化、剪枝与知识蒸馏,并已实现对 Habana Gaudi 加速器的支持,其性价比比 GPU 高出最多 40%。

6月14日周二
6月13日周一
6月9日周四
6月7日周二
6月2日周四
5月26日周四
5月25日周三
5月24日周二