跳到正文

#教程/实践

今日 0 条
4月26日周二
4月25日周一
4月5日周二
  1. Hugging Face Blog22

    Hugging Face 为何在 Transformers 中放弃 DRY 原则

    Hugging Face 的 Transformers 库有意不遵循 DRY 原则,转而采用“单模型文件”策略:模型前向传播所需的全部代码只放在一个模型文件中,注意力机制代码因此被复制到 50 多个模型文件里。官方给出的理由包括该库由开源社区共建、建模代码本身就是产品、机器学习领域演进极快,以及模型发布后基本不再改动。

3月17日周四
3月16日周三
  1. Hugging Face Blog22

    用 🤗 datasets 实现图像搜索

    Hugging Face 的 🤗 datasets 现已支持图像特征类型,可结合 sentence_transformers 和 faiss 为图像数据集构建相似度搜索应用。文中以英国图书馆数字化书籍插图数据集为例,通过 ImageFolder 加载器直接载入含 image 和 label 特征的 10000 行数据,并利用 datasets 内置的 faiss 索引能力实现图像检索。

3月11日周五
3月2日周三
2月11日周五
2月2日周三
2月1日周二
  1. Hugging Face Blog40

    如何在 🤗 Transformers 中用 Wav2Vec2 对超大文件做自动语音识别

    Hugging Face 博客介绍了利用 Wav2Vec2 的 CTC 架构特性,通过带 stride 的重叠分块推理,让 ASR 在任意长音频上也能保持高质量识别。只需在 pipeline 中设置 chunk_length_s 和 stride_length_s,即可避免直接处理长文件时的显存溢出,该技巧同样适用于 LM 增强的 Wav2Vec2 模型,并可用于实时推理。

1月25日周二
1月12日周三
1月11日周二
12月23日周四
12月14日周二
12月8日周三
2月26日周二
8月29日周一