Diffusers 原生支持 Nunchaku 4-bit 扩散推理
Diffusers 现已原生支持 Nunchaku 的 SVDQuant 4-bit 量化推理,加载 Nunchaku checkpoint 只需调用 from_pretrained(),无需本地编译 CUDA,内核通过 kernels 包从 Hub 下载。
推荐理由:原文给出 Nunchaku Lite 在 Diffusers 中的加载方式、显存与延迟数据,读者可据此判断消费级 GPU 跑扩散模型的实际收益。
Diffusers 现已原生支持 Nunchaku 的 SVDQuant 4-bit 量化推理,加载 Nunchaku checkpoint 只需调用 from_pretrained(),无需本地编译 CUDA,内核通过 kernels 包从 Hub 下载。
推荐理由:原文给出 Nunchaku Lite 在 Diffusers 中的加载方式、显存与延迟数据,读者可据此判断消费级 GPU 跑扩散模型的实际收益。
OpenAI 发布企业 AI 智能体平台 OpenAI Presence,用于部署可信的语音和聊天智能体,覆盖客户与内部工作流。
NTT DATA Group 借助 ChatGPT Enterprise 和 Codex,帮助 9,000 名员工实现工作自动化,并将事件分析时间缩短至 30 分钟。该集团同时借此推进安全可控的 AI 规模化落地。
OpenAI 推出 ChatGPT for Small Businesses 计划,帮助创业者建立 AI 技能、自动化工作,并借助 ChatGPT Work 实现增长。
Hugging Face 博客发布开源低成本机器人操作数据采集系统 Grabette,用手持夹爪加双摄像头记录人类演示,自动转换为 LeRobot 数据集。Grabette 手持端 BOM 成本约 490€,配套的 Gripette 电动夹爪约 120€,硬件 CAD、采集服务、处理流水线和示例训练栈全部开源,处理流程可在浏览器中通过 HF Space 完成。
推荐理由:原文给出了手持夹爪采集机器人操作数据的完整开源方案与成本,读者可据此判断数据采集门槛的变化。
OpenAI 创意团队借助 Codex 构建定制创意工具,加速创意构思并更快完成原型开发。Codex 作为具备上下文感知能力的 AI,已成为该团队的协作伙伴。
印度二手车平台 Cars24 借助 OpenAI 的语音与聊天智能体,每月处理超 100 万分钟对话,并挽回 12% 的流失线索。该公司还将智能体工作流推广至全公司各团队,以加快内部构建速度。
Google DeepMind 面向印度 Atal Tinkering Labs 启动 ATL Saathi 试点,这是一款由 Gemini 驱动的 Web 应用,为每位 Tinkering Lab 教育者提供 24/7 备课与培训助手。
Mistral 宣布 Studio 即日起为 Prompts 和 Skills 提供集中管理系统,每个资产可版本化、指定归属并追溯。Studio 将提示词和技能视为生产资产,提供不可变版本、回滚、分类标签和审计日志,并可通过 SDK 接入 GitHub Actions 触发 CI/CD。技能可作为 MCP 服务器直接从 Studio 调用,生产执行的与版本化的资产保持一致。
推荐理由:原文给出提示词与技能版本化、归属和审计的具体机制,读者可据此判断企业如何治理 AI 行为。
OpenAI 发布 ChatGPT Work,这是一个可在多个应用和文件间执行操作的智能体。它能在需要时为同一项目持续工作数小时,并把一个目标转化为完成的工作成果。
推荐理由:官方给出 ChatGPT Work 的定位,读者可据此判断智能体跨应用执行任务的能力边界。
Hugging Face 宣布 vLLM 的 transformers 建模后端现已达到甚至超过 vLLM 手写原生实现的吞吐速度,模型作者无需移植即可获得快速推理。
推荐理由:原文给出 transformers 后端在 vLLM 中追平原生实现的具体基准与启用方式,读者可据此判断是否省去自定义移植。
Hugging Face 与 Amazon SageMaker AI 推出深度链接集成,开发者在支持的模型页面点击 Customize 或 Deploy 即可直达 SageMaker Studio,模型预加载、环境自动配置。
微软在 Build 2026 宣布 Foundry Managed Compute 及 Hugging Face 模型集合,将 Hugging Face 生态的开源权重模型引入 Foundry 模型目录,每周刷新并可一键部署到托管 GPU 平台。
Australian Payments Plus 使用 ChatGPT Enterprise 和 Codex 应对支付业务的复杂性,实现节省时间、提升质量,同时保留人工判断。
LeRobot v0.6.0 发布,围绕机器人学习闭环引入世界模型策略(VLA-JEPA、FastWAM、LingBot-VA)、新一批 VLA(GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT)以及统一奖励模型 API(Robometer、TOPReward)。
推荐理由:LeRobot v0.6.0 把世界模型策略、奖励模型 API 与六个仿真基准整合进同一套开源工作流,读者可据此判断机器人学习闭环的落地路径。
Hugging Face 与 SkyPilot 联合推出集成,用户可用一个 hf:// URL 和现有 HF_TOKEN 把 Hugging Face Bucket 或任意模型、数据集、Space 仓库挂载进 SkyPilot 任务,并在 20+ 云、Kubernetes、Slurm 和本地集群上运行。
推荐理由:原文给出 hf:// 挂载方式、免出网费与 Xet 去重的具体机制,读者可据此判断跨云训练存储成本的变化。
用 @GoogleAIStudio 构建 在这里制作你自己的片段 :) world-cup-hero.ai.studio/
Hugging Face 为 Kernels 项目引入 Hub 上的 "kernel" 新仓库类型,并默认只加载受信任发布者的内核,其他来源需显式传入 trust_remote_code=True。
Hugging Face 与 Cerebras 联合演示了一套实时语音到语音流水线,用 Cerebras 加速 Gemma 4 31B 的推理,以降低语音交互延迟。
推荐理由:原文给出可替换的语音到语音流水线各层组件,读者可据此评估如何搭建低延迟实时语音交互。
Google Research 将建筑级屋顶反射率数据集从 14 城扩展至 50+ 城市,覆盖 9 个国家,并通过新的 Heat Resilience Earth Engine App 开放访问。该方法融合 Sentinel-2 与 30-cm 高分辨率卫星影像,在 Boulder 验证中 RMSE 仅 0.04,建模显示针对性冷屋顶规划可使全球城市极端高温降低最多 0.5°C。
Hugging Face 模型页现已展示 Every Eval Ever(EEE)评测结果,EEE 与 Hugging Face Community Evals 实现互操作,支持结果交叉发布与溯源。
Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前它仅作为独立的 Gemini 2.5 computer use 模型提供。
推荐理由:原文说明 computer use 从独立模型并入 Gemini 3.5 Flash 主模型,并给出 API 与安全防护入口,便于判断智能体落地的可用性。
我们很高兴支持 BitRobot 开源在真实家庭环境中采集的最大人形机器人全身遥操作数据集。我们希望这能加速通用人形机器人的发展。😉
Mistral 为 Connectors 推出多项新能力:管理员控制、带 connector 作用域的 API key、多账号 connector 与 Connectors Debugger 均已 GA 或进入 Public Preview。
GPT-5 Pro 帮助免疫学家 Derya Unutmaz 破解了一个持续三年的免疫学难题,给出了关于 T 细胞行为的见解。这一进展可能为癌症和自身免疫研究提供支持。
推荐理由:原文交代了 GPT-5 Pro 在免疫学问题上的具体应用场景,读者可了解大模型参与科研推理的一种路径。
Omio 正借助 OpenAI 构建对话式旅行体验,并推动自身转型为 AI 原生公司。该案例还展示了 Omio 如何用 OpenAI 加速产品开发。
OpenAI 推出新的 Daybreak 工具,包括 Codex Security 和 GPT-5.5-Cyber,帮助各类组织大规模发现、验证并修补漏洞。
推荐理由:OpenAI 推出面向安全场景的 Daybreak 工具,读者可了解其漏洞发现与修复的定位。
我们今天下午将在这里举办 Midjourney Medical AMA(有问必答)。 在下方提出你们的问题,我们会尽量回答尽可能多的问题!❤️
OpenAI 为 ChatGPT Enterprise 新增支出控制与用量分析功能,帮助企业管理成本并扩展 AI 应用。
OpenAI 用 GPT-5.5 Instant 改进 ChatGPT 的健康与养生回答,强化推理、上下文理解与表达清晰度,并引入医生参与设计的评估。该版本针对健康类问题优化,具体上线范围与参数未披露。
Hugging Face 发布 Agentic Resource Discovery(ARD)规范的参考实现 Discover Tool,让智能体在运行时按自然语言搜索能力,而不再依赖预先安装。
推荐理由:Hugging Face 给出 ARD 规范的参考实现与 CLI、REST、MCP 三种调用入口,可据此判断智能体能力发现如何从预装目录转向运行时检索。