OpenAI 如何安全运行 Codex
OpenAI 通过沙箱隔离、审批机制、网络策略和智能体原生遥测来安全运行 Codex,以支持安全合规地采用编码智能体。
OpenAI 通过沙箱隔离、审批机制、网络策略和智能体原生遥测来安全运行 Codex,以支持安全合规地采用编码智能体。
PipelineRL 在 vLLM V0 到 V1 迁移中通过四项修复让 V1 与 V0 参考轨迹对齐:启用 processed_logprobs、显式关闭 prefix caching 与 async scheduling、匹配 inflight 权重更新路径,以及最终投影使用 fp32 lm_head。
OpenAI 重建了其 WebRTC 技术栈,以支撑实时语音 AI 的低延迟、全球规模与流畅的对话轮次切换。
OpenAI 本周在 Hugging Face Hub 开源 Privacy Filter,一个 1.5B 参数、50M 激活参数的 PII 检测模型,Apache 2.0 许可,单次前向即可在 128k 上下文内标注八类个人信息,并在 PII-Masking-300k 基准上达到 SOTA。
OpenAI 分享 ChatGPT Work 在重复性任务、更新、研究、规划和团队运营中的实用工作流。内容面向日常办公场景,帮助用户把这些流程落地到实际工作中。
Hugging Face 发布 Transformers.js 浏览器扩展教程,演示如何在 Manifest V3 约束下用 Gemma 4 E2B 构建本地 AI 功能。
OpenAI 介绍如何用 ChatGPT 进行头脑风暴,把粗略想法整理成结构化、可执行的计划。内容涵盖激发创意与梳理思路,帮助用户将零散概念转化为可落地的方案。
OpenAI 发布提示词基础指南,讲解如何写出清晰有效的提示词,以从 ChatGPT 获得更好、更有用的回答。内容面向希望提升提示词质量的用户,属于入门级方法讲解。
OpenAI 发布面向财务团队的 ChatGPT 工作流指南,覆盖财务分析、报告、规划与决策沟通等场景。内容聚焦如何将 ChatGPT 用于日常财务工作,帮助团队完成可支撑决策的沟通输出。
ChatGPT 的 projects 功能可用来整理对话、文件和指令,管理持续推进的工作并提升协作效率。该功能将聊天记录、文件与自定义指令归入同一项目空间,便于围绕长期任务集中管理。
OpenAI 介绍如何用 ChatGPT 的搜索与深度研究功能开展研究,以获取最新信息、分析来源并生成结构化洞察。
OpenAI 介绍在 ChatGPT 中处理文件的实用方法,涵盖查找信息、整理、转换文档以及将文件用于工作流。内容围绕文件操作的实际用法展开,未披露具体模型版本或功能参数。
OpenAI 发文介绍管理者如何用 ChatGPT 准备沟通、撰写清晰反馈、保持条理并提升团队效率。内容面向管理场景,未涉及具体模型版本或新功能。
OpenAI 发布面向销售团队的 ChatGPT 实用工作流,覆盖客户调研、会议准备、外联、销售管道复盘和销售执行。
ChatGPT 支持通过清晰的提示词创建并迭代优化图像,几分钟内即可生成高质量视觉内容。教程涵盖提示词撰写、设计迭代等具体方法。
ChatGPT 可用于探索数据集、生成洞察、创建可视化,并将分析发现转化为可执行的决策。
OpenAI 发布面向初学者的 AI 基础科普,解释 AI 是什么、如何运作,以及 ChatGPT 这类工具如何调用大语言模型。内容以清晰易懂的方式讲解人工智能的基本概念,帮助零基础读者建立认知。
OpenAI 发布 AI 负责任与安全使用指南,围绕安全、准确性和透明度给出最佳实践,适用于 ChatGPT 等工具的使用场景。
OpenAI 发布指南,介绍如何用 ChatGPT 做研究:收集来源、分析信息,并生成结构化、带引用支撑的洞察。
OpenAI 发布指南,介绍如何用 ChatGPT 进行写作,完成内容的起草、修改与润色,并保持清晰的结构、语气和意图。
Mistral 基于其开源编码助手 Vibe 构建了一个自主智能体,可读取 Rails 源文件、生成或改进 RSpec 测试,并在 CI/CD 流水线中无需人工干预地并行运行。通过仓库级 AGENTS.md 执行计划和按文件类型划分的 SKILLS 文件,其质量评分从 0.68 提升至 0.74。
Hugging Face 对 16 个围绕异步训练构建的开源 RL 库做了横评,按编排原语、rollout buffer 设计、权重同步协议、陈旧度管理、部分 rollout 处理、LoRA 支持与分布式训练后端 7 个维度对比。
Hugging Face 博客详解源自 Snowflake AI Research 的 Ulysses 序列并行(ALST 协议的一部分),通过注意力头并行与 all-to-all 通信把长序列切分到多 GPU,突破单卡显存限制。
Hugging Face 博客发布 NXP 的实践指南,介绍如何在嵌入式机器人平台上部署 VLA 模型,涵盖数据集录制、ACT 与 SmolVLA 策略微调以及端侧优化。文中以“把茶包放进杯子”任务为例,录制 120 个 episode,将工作空间划分为 11 个 10×10 cm 起始位置簇,并建议约 20% 训练集为恢复 episode。NXP i.MX 95 SoC 在优化后实现了实时性能。
Photoroom 发布 PRX 系列第三篇,用 32 张 H200、约 1500 美元算力预算在 24 小时内完成一次文生图模型训练,并开源训练代码与实验框架。
推荐理由:Photoroom 公开了 24 小时训练文生图模型的完整配方与代码,读者可据此复现并调整各组件。
Hugging Face 发文介绍 transformers 库如何为 MoE 模型重构支持,涵盖权重加载、专家后端、专家并行与训练四部分。权重加载引入 WeightConverter 与惰性物化,将 256 个独立专家张量打包为单个连续张量;在 Qwen1.5-110B-Chat 上,v5 异步加载耗时 20.71s,v4 为 66.24s,张量并行下为 10.1s。
Hugging Face 发布教程,介绍如何通过 Claude Code、Codex 等编码智能体,用 Unsloth 和 Hugging Face Jobs 微调 LiquidAI/LFM2.5-1.2B-Instruct。
推荐理由:原文给出用编码智能体提交微调任务的完整命令与技能安装步骤,读者可据此复现小模型训练流程。
Hugging Face 博客介绍 Gradio 6 中 gr.HTML 的新能力,支持自定义模板、作用域 CSS 和 JavaScript 交互,可在单个 Python 文件中完成前端、后端与状态管理,无需构建步骤即可部署到 Hugging Face Spaces。
推荐理由:原文给出 gr.HTML 的模板、状态同步与子类化写法,读者可据此把自定义组件直接接入现有 Gradio 流程。
Hugging Face 发布 cuda-kernels Agent Skill,让 Claude、Codex 等编码智能体为 diffusers 和 transformers 项目编写生产级 CUDA 内核,并生成 PyTorch 绑定与基准脚本。
推荐理由:原文给出可安装的 CUDA 内核技能与完整基准数据,读者可据此判断智能体写内核的可行边界。
OpenAI 技术人员 Ryan Lopopolo 提出 Harness engineering,探讨在智能体优先的世界中如何利用 Codex。文章聚焦于围绕 Codex 构建工程化支撑体系,以适应以 AI 智能体为核心的开发范式。
OpenAI 介绍 Codex App Server,这是一个双向 JSON-RPC API,用于把 Codex 智能体嵌入到应用中。该接口支持流式进度、工具调用、审批和 diff 等能力。
Hugging Face 公布 PRX 文本到图像模型训练消融实验,以 1.2B 参数 PRX-1.2B 为基线,在 Flux VAE latent 空间、256×256 分辨率、全局 batch size 256 下训练 100k 步。
Hugging Face 发布新工具 upskill,可用大模型生成并评测 agent skill,再交给更小或本地模型使用。文章以用 Claude Opus 4.5 编写 diffusers 模型 CUDA kernel 为例,upskill 会基于 agent trace 生成技能和测试用例,并对比有无技能时的准确率与 token 消耗。
推荐理由:原文给出用大模型生成并评测 agent skill 再迁移到小模型的完整流程,可复用到其他专业任务。
Hugging Face 博客复盘了用 verl 框架对 GPT-OSS 进行智能体强化学习训练时遇到的问题与修复。团队发现 GPT-OSS-20B 训练初期出现 KL 散度和熵爆炸、奖励不升,根因是 MoE 架构下双前向传播导致新旧 log-prob 不一致,使 PPO 的 importance sampling ratio 偏离 1;修复后该方案同样适用于 GPT-OSS-120B。
OpenAI 技术解析 Codex 智能体循环,说明 Codex CLI 如何借助 Responses API 编排模型、工具、提示词与性能。
ChatGPT 帮助小团队分析数据、制作营销素材、管理预算、主持会议并做出更好的决策。这是一份面向小团队的实用指南,展示如何用 ChatGPT 覆盖数据分析、营销、预算、会议与决策等日常场景。
Mistral AI 团队在 vLLM 上排查一起内存泄漏,问题只在 Mistral Medium 3.1、开启图编译的 Prefill/Decode 分离部署中出现,系统内存以每分钟 400 MB 线性增长,数小时后触发 out of memory。Memray、Guppy 3 均未发现泄漏,Heaptrack 显示堆内存稳定但峰值 RSS 存在差异,说明泄漏发生在堆之外。
OpenAI 发布《构建 AI Agent 实用指南》,系统讲解 AI Agent 的设计、编排与部署。内容覆盖用例选择、模型选型、工具设计、护栏设置以及多 Agent 模式等关键环节,为开发者落地 AI Agent 提供一站式参考。
OpenAI 发布了一份面向初创公司的 GPT-5 Model Series 实战指南,涵盖迁移到 Responses API、设计 agent、调优提示词、操控 GPT-5 模型以及构建可靠 AI 工作流等实操内容。指南聚焦从旧接口迁移与 agent 架构设计到提示词调优的完整落地路径,帮助团队把 GPT-5 稳定接入生产环境。
OpenAI 详细介绍了其内部团队如何使用 Codex 来理解代码、重构系统、提升性能、加快开发速度并优化工程工作流。Codex 作为 OpenAI 的编程工具,被应用于代码理解、系统重构、性能优化等多个环节,以提升整体工程效率。