跳到正文

#教程/实践

今日 0 条
5月8日周五
5月7日周四
5月4日周一
4月27日周一
4月23日周四
4月10日周五
  1. OpenAI News22

    如何在 ChatGPT 中处理文件

    OpenAI 介绍在 ChatGPT 中处理文件的实用方法,涵盖查找信息、整理、转换文档以及将文件用于工作流。内容围绕文件操作的实际用法展开,未披露具体模型版本或功能参数。

3月11日周三
3月10日周二
3月9日周一
3月5日周四
  1. Hugging Face Blog30

    Hugging Face 博客:将机器人 AI 带到嵌入式平台——数据集录制、VLA 微调与端侧优化

    Hugging Face 博客发布 NXP 的实践指南,介绍如何在嵌入式机器人平台上部署 VLA 模型,涵盖数据集录制、ACT 与 SmolVLA 策略微调以及端侧优化。文中以“把茶包放进杯子”任务为例,录制 120 个 episode,将工作空间划分为 11 个 10×10 cm 起始位置簇,并建议约 20% 训练集为恢复 episode。NXP i.MX 95 SoC 在优化后实现了实时性能。

3月4日周三
2月26日周四
  1. Hugging Face Blog52

    Hugging Face 详解 transformers 中的 MoE 支持

    Hugging Face 发文介绍 transformers 库如何为 MoE 模型重构支持,涵盖权重加载、专家后端、专家并行与训练四部分。权重加载引入 WeightConverter 与惰性物化,将 256 个独立专家张量打包为单个连续张量;在 Qwen1.5-110B-Chat 上,v5 异步加载耗时 20.71s,v4 为 66.24s,张量并行下为 10.1s。

2月20日周五
2月18日周三
  1. Hugging Face Blog63

    Hugging Face 介绍 Gradio gr.HTML 单文件构建任意 Web 应用

    Hugging Face 博客介绍 Gradio 6 中 gr.HTML 的新能力,支持自定义模板、作用域 CSS 和 JavaScript 交互,可在单个 Python 文件中完成前端、后端与状态管理,无需构建步骤即可部署到 Hugging Face Spaces。

    推荐理由:原文给出 gr.HTML 的模板、状态同步与子类化写法,读者可据此把自定义组件直接接入现有 Gradio 流程。

2月13日周五
  1. Hugging Face Blog62

    Hugging Face 发布 CUDA 内核 Agent Skill,Claude 与 Codex 为 LTX-Video 和 Qwen3-8B 生成内核

    Hugging Face 发布 cuda-kernels Agent Skill,让 Claude、Codex 等编码智能体为 diffusers 和 transformers 项目编写生产级 CUDA 内核,并生成 PyTorch 绑定与基准脚本。

    推荐理由:原文给出可安装的 CUDA 内核技能与完整基准数据,读者可据此判断智能体写内核的可行边界。

2月11日周三
2月4日周三
2月3日周二
1月28日周三
  1. Hugging Face Blog62

    Hugging Face 发布 upskill:用 Claude 生成 CUDA kernel 技能并教给开源模型

    Hugging Face 发布新工具 upskill,可用大模型生成并评测 agent skill,再交给更小或本地模型使用。文章以用 Claude Opus 4.5 编写 diffusers 模型 CUDA kernel 为例,upskill 会基于 agent trace 生成技能和测试用例,并对比有无技能时的准确率与 token 消耗。

    推荐理由:原文给出用大模型生成并评测 agent skill 再迁移到小模型的完整流程,可复用到其他专业任务。

1月27日周二
  1. Hugging Face Blog38

    解锁 GPT-OSS 的智能体 RL 训练:一次实践复盘

    Hugging Face 博客复盘了用 verl 框架对 GPT-OSS 进行智能体强化学习训练时遇到的问题与修复。团队发现 GPT-OSS-20B 训练初期出现 KL 散度和熵爆炸、奖励不升,根因是 MoE 架构下双前向传播导致新旧 log-prob 不一致,使 PPO 的 importance sampling ratio 偏离 1;修复后该方案同样适用于 GPT-OSS-120B。

1月23日周五
1月22日周四
  1. Mistral AI37

    堆内存会说谎:排查 vLLM 内存泄漏

    Mistral AI 团队在 vLLM 上排查一起内存泄漏,问题只在 Mistral Medium 3.1、开启图编译的 Prefill/Decode 分离部署中出现,系统内存以每分钟 400 MB 线性增长,数小时后触发 out of memory。Memray、Guppy 3 均未发现泄漏,Heaptrack 显示堆内存稳定但峰值 RSS 存在差异,说明泄漏发生在堆之外。

1月15日周四
  1. OpenAI News44

    GPT-5 Model Series 构建实战指南

    OpenAI 发布了一份面向初创公司的 GPT-5 Model Series 实战指南,涵盖迁移到 Responses API、设计 agent、调优提示词、操控 GPT-5 模型以及构建可靠 AI 工作流等实操内容。指南聚焦从旧接口迁移与 agent 架构设计到提示词调优的完整落地路径,帮助团队把 GPT-5 稳定接入生产环境。

  2. OpenAI News34

    OpenAI 如何用 Codex 加速工程开发

    OpenAI 详细介绍了其内部团队如何使用 Codex 来理解代码、重构系统、提升性能、加快开发速度并优化工程工作流。Codex 作为 OpenAI 的编程工具,被应用于代码理解、系统重构、性能优化等多个环节,以提升整体工程效率。