微调 GPT-3 以规模化视频创作
通过对 GPT-3 进行微调,将其用于驱动并规模化"代客制作"的视频创作。
通过对 GPT-3 进行微调,将其用于驱动并规模化"代客制作"的视频创作。
OpenAI 正利用 GPT-3 创建新一代 AI 驱动的角色。该方向聚焦于以 GPT-3 生成更具表现力的虚拟角色,具体产品形态与可用性尚未披露。
OpenAI 训练并发布名为 ChatGPT 的模型,以对话方式与用户交互。官方称对话格式让 ChatGPT 能回答追问、承认自身错误、质疑错误前提并拒绝不当请求。
推荐理由:OpenAI 官方给出 ChatGPT 的对话式交互定位,读者可据此了解它与以往模型的形态差异。
OpenAI 宣布 DALL·E API 从今天起进入公开测试,开发者可以开始用它构建应用。
Hugging Face 将 Intel OpenVINO 加入 Optimum Intel,用户可在多种 Intel 处理器上用 OpenVINO Runtime 对 Transformers 模型执行推理,模型可托管于 Hugging Face hub 或本地。
Hugging Face 推出 Inference Endpoints,可从 Hub 直接一键将模型部署到所选云平台的托管基础设施上,支持公有、受保护、私有三种访问级别。
Hugging Face 宣布用户可直接在 Hub 上为模型或数据集生成 DOI,该功能已与 DataCite 合作实现。注册用户填写必要元数据后即可获得 DOI,他人可通过模型或数据集页面上的“Cite this model/dataset”按钮引用其工作。带 DOI 的数据集和模型将被永久保留,仅可在向官方支持提交请求后删除。
Hugging Face 在 Evaluation on the Hub 上线零样本分类评测,由 AutoTrain 驱动,无需写代码即可评测 Hub 上的任意因果语言模型,目前支持最大 66B 参数模型。
OpenAI 宣布 DALL·E 取消等待名单,新用户可以直接开始创作。官方称,部署中积累的经验以及安全系统的改进,使更广泛的开放成为可能。
推荐理由:原文交代了 DALL·E 取消等待名单的开放变化,读者可据此了解其使用门槛与安全系统调整。
Hugging Face AutoTrain 新增图像分类任务,用户无需编写代码即可上传数据训练模型,AutoTrain 会自动尝试多种模型架构并挑选最优方案。演示中 5 个候选模型里表现最佳者达到 84% 准确率,训练少于 500 张图片、5 个候选模型时免费。
Hugging Face 发布 diffusers 0.3,为扩散模型工具箱新增图生图 pipeline、文本反转、实验性 inpainting pipeline、ONNX 导出器与 Mac 支持。其中显存优化让 Stable Diffusion 只需 3.2GB 显存,代价是约 10% 的速度损失;文本反转支持用 3-5 张样本个性化模型,社区几天内分享了 200 多个概念。
推荐理由:梳理 diffusers 0.3 新增的图生图、文本反转、inpainting 与显存优化,可据此判断扩散模型工具链的可用边界。
OpenAI 为 DALL·E 推出 outpainting 功能,可生成任意尺寸的图像,用于扩展创作画面、讲述更大的故事。
Hugging Face 发布新库 Skops,可将 scikit-learn 模型托管到 Hugging Face Hub,并生成模型卡进行文档记录与协作。Skops 通过 hub_utils.init 生成含模型文件与环境配置的本地仓库,后端使用 joblib 加载模型,支持 pickle 等序列化方式。
OpenAI 发布新版内容审核工具 Moderation endpoint,改进此前的内容过滤器,即日起向 OpenAI API 开发者免费开放。
Hugging Face 发布 Private Hub(PH),将模型、数据集、Spaces 等 ML 工具整合到统一平台,支持企业在安全合规环境下协作开发。Hugging Face Hub 现有超 60K 模型、6K 数据集和 6K 演示应用,模型覆盖 180 种语言、支持最多 25 个 ML 库。约 90% 的机器学习模型从未进入生产环境,PH 旨在加速从研究到生产的全流程。
Hugging Face 为 🤗 Datasets 补充了音频和图像数据集的文档,Quickstart 新增按模态选择数据集的端到端示例,并引入 to_tf_dataset 函数,可将数据集转换为 tf.data.Dataset 供 TensorFlow 或 Keras 训练。
OpenAI 宣布 DALL·E 进入测试版,将在未来几周从候补名单中邀请 100 万人使用。用户可用每月重置的免费额度生成图像,也可按 115 次生成一档、15 美元的价格购买额外额度。
推荐理由:原文给出 DALL·E 测试版开放规模与免费额度、付费增量价格,便于读者了解早期图像生成产品的开放方式。
OpenAI 在 DALL·E 2 研究预览中,已有来自 118 个以上国家的 3000 多名艺术家将 DALL·E 融入创作流程。早期访问组的艺术家帮助发现了 DALL·E 的新用途,并在 DALL·E 功能决策中提供了关键意见。
Hugging Face 推出 Evaluation on the Hub,由 AutoTrain 驱动,用户无需写一行代码即可在 Hub 上用任意数据集和指标评测任意模型。评测结果会以 Pull Request 形式写入模型卡元数据,并可在数据集页面的榜单中对比不同模型表现。官方已用该工具评测了数百个模型,并给出文本分类、命名实体识别和文本摘要等可直接试用的数据集。
推荐理由:原文说明了无需写代码即可在 Hub 上评测任意模型与数据集,并给出配置流程和榜单入口。
Graphcore 与 Hugging Face 在开源库 Optimum 中新增一批适配 IPU 的 Transformer 模型,可访问模型总数达 10 个,覆盖 NLP、语音和计算机视觉,均附带 IPU 配置文件和预训练、微调权重。
Hugging Face 在 Hub 上线 pull requests 和 discussions,模型、数据集和 Spaces 三类仓库均可在 Community 标签页使用,任何社区成员都能创建和参与。
OpenAI Codex 现已通过 OpenAI API 为 70 款不同应用提供支持,覆盖多种使用场景。
OpenAI 更新 DALL·E 2 研究预览进展,早期用户迄今已生成超过 300 万张图像,并帮助改进了安全流程。OpenAI 表示将开始每周从候补名单中新增最多 1000 名用户。
推荐理由:早期用户已生成超 300 万张图像,官方据此说明安全流程改进与每周放量节奏。
Hugging Face 发布 Gradio 3.0,对 Gradio 库做了彻底重设计,前端改用 Svelte 等现代技术,页面体积更小、加载更快,并新增 Gallery 组件和 TabbedInterface 类。
推荐理由:Gradio 3.0 的前端重写与 Blocks 低层 API 展示了从固定布局到自定义数据流的转变,可据此判断演示搭建方式的变化。
Hugging Face 在 Optimum 1.2 中加入推理与 Transformers pipelines 支持,首批接入 ONNX Runtime,用户可将 AutoModelForXxx 直接替换为对应的 ORTModelForXxx。
fastai 用户现在可以用一行 Python 将模型上传至 Hugging Face Hub,并通过 from_pretrained_fastai 直接加载他人模型。
Hugging Face 为 huggingface_hub 库新增 emissions_threshold 参数,可按训练碳排放量筛选 Hub 上的模型,例如筛选出 191 个排放不超过 100 克的模型。transformers 则通过集成 codecarbon,在 Trainer 训练时自动记录碳排放并生成 emissions.csv,方便开发者将数据填入模型卡。
OpenAI 在 API 中推出 embeddings 端点,用于自然语言和代码任务。该端点可支持语义搜索、聚类、主题建模和分类等场景。
推荐理由:OpenAI 在 API 中新增 embeddings 端点,读者可了解它面向语义搜索、聚类等任务的定位。
Hugging Face 宣布将 PyTorch 深度强化学习库 Stable-Baselines3 集成到 Hugging Face Hub,用户可通过 pip install huggingface_sb3 上传和加载已保存的模型。
Hugging Face 公布 Infinity 在第三代 Intel Xeon 可扩展处理器(Ice Lake)上的端到端推理基准:为 DistilBERT 序列分类任务优化的容器相比同平台原生 Transformers 延迟与吞吐最高提升 800%,相比上一代 Cascade Lake 实例提升 34%。
OpenAI 发布文章介绍为应用定制 GPT-3 的方法,指出可通过单条命令完成微调。
OpenAI 宣布其 API 不再需要等待名单,向更多开发者开放。官方表示,这一更广泛的可用性得益于安全方面的进展。
推荐理由:OpenAI 宣布 API 取消等待名单,读者可据此了解其开放节奏与安全进展的关系。
OpenAI 推出改进版 Codex,这一将自然语言转换为代码的 AI 系统即日起通过 API 开放私测。
OpenAI 发布 Triton 1.0,这是一门类 Python 的开源编程语言,让没有 CUDA 经验的研究者也能编写高效的 GPU 代码,性能多数情况下可达到专家水平。
推荐理由:OpenAI 开源 Triton 1.0,让没有 CUDA 经验的研究者也能写出接近专家水平的 GPU 代码。
Hugging Face 发布 Accelerate 库,原文正文抓取失败,仅标题可用。
OpenAI 表示,已有超过 300 款应用通过其 API 提供由 GPT-3 驱动的搜索、对话、文本补全等 AI 功能。
OpenAI 发布了一个 API,用于访问 OpenAI 开发的新 AI 模型。
OpenAI 推出 Microscope,对八个常用于可解释性研究的视觉“模式生物”模型的每个重要层和神经元进行可视化。该工具让分析这些神经网络内部形成的特征变得更容易,OpenAI 希望借此帮助研究社区理解这类复杂系统。
OpenAI 发布强化学习游戏平台 Gym Retro 完整版,公开游戏数量从约 70 款 Atari 和 30 款 Sega 游戏扩展至超过 1000 款,覆盖多种模拟器后端。OpenAI 同时发布了用于向该平台添加新游戏的工具。
OpenAI 开源了一个基于 MuJoCo 引擎的高性能 Python 机器人仿真库,该库源自其过去一年的机器人研究。