Overworld 发布实时交互视频扩散模型 Waypoint-1
Overworld 发布实时交互式视频扩散模型 Waypoint-1,可通过文本、鼠标和键盘控制,权重已上传 Hugging Face Hub,先开放 Waypoint-1-Small,Medium 版本即将推出。
推荐理由:Waypoint-1 把实时交互式视频扩散模型和推理库一并开源,读者可据此了解世界模型从控制输入到消费级硬件落地的路径。
把模型跑起来的工程实践:推理优化、显存与成本、Serving 架构与基础设施选型。
Overworld 发布实时交互式视频扩散模型 Waypoint-1,可通过文本、鼠标和键盘控制,权重已上传 Hugging Face Hub,先开放 Waypoint-1-Small,Medium 版本即将推出。
推荐理由:Waypoint-1 把实时交互式视频扩散模型和推理库一并开源,读者可据此了解世界模型从控制输入到消费级硬件落地的路径。
Mistral AI 发布 Mistral OCR 3,在表单、扫描件、复杂表格和手写内容上相对 Mistral OCR 2 的整体胜率为 74%。
推荐理由:官方给出与 Mistral OCR 2 的胜率对比、每千页定价和自托管选项,便于评估文档解析成本与合规。
llama.cpp server 新增 router 模式,可在不重启服务的情况下动态加载、卸载和切换多个模型,实现类似 Ollama 的模型管理。
推荐理由:llama.cpp server 新增 router 模式,读者可了解本地多模型动态加载与切换的具体用法和配置项。
Hugging Face 发布 Transformers v5.0.0rc-0,距 v4 首个候选版已五年,如今该库每天通过 pip 安装超过 300 万次,累计安装量超过 12 亿次。
推荐理由:官方梳理了 v5 在模型定义、训练、推理与量化上的取舍,可据此判断现有工作流是否需要迁移。
Google 公布研究项目 Project Suncatcher,设想由太阳能卫星组成星座、搭载 Google TPU 并通过自由空间光链路互联,以在太空扩展 AI 算力。
推荐理由:Google 公开了太空 AI 基础设施的预印本,给出卫星互联、轨道与 TPU 抗辐射的实测数据,可了解这一设想的技术边界。
OpenAI 与 AWS 达成多年期、金额 380 亿美元的战略合作,用于扩展先进 AI 工作负载。AWS 将提供基础设施和算力,支撑 OpenAI 下一代模型。
推荐理由:原文披露了 380 亿美元多年期合作与算力供给安排,读者可据此了解 OpenAI 的算力来源布局。
Hugging Face 发布分析文章,指出中国开源权重模型的推理已开始由华为昇腾、寒武纪等国产芯片承载,部分模型开始用国产芯片训练。文章认为美国出口管制与中国芯片产能提速高度相关,芯片稀缺也促使 DeepSeek 的 MLA、GRPO 等算力效率创新走向开源。
推荐理由:梳理中国算力从被限制到自建全栈的路径,帮助读者理解开源模型与国产芯片如何互相推动。
Hugging Face 发布 huggingface_hub v1.0,这是该库五年来的首个大版本,带来多项破坏性变更。主要变化包括底层从 requests 迁移到 httpx、文件传输全面改用 hf_xet 取代 hf_transfer,以及用基于 Typer 的 hf CLI 替换已弃用的 huggingface-cli。
推荐理由:官方梳理了 huggingface_hub v1.0 的破坏性变更与迁移路径,可据此评估自家依赖库的升级成本。
Mistral AI 发布 AI Studio,一个面向企业团队的生产 AI 平台,由 Observability、Agent Runtime 和 AI Registry 三大支柱组成。
推荐理由:原文完整交代了三大支柱的能力边界与私有 beta 入口,读者可据此判断企业级 AI 生产化工具链的构成。
OpenAI 与 Broadcom 宣布多年期战略合作,将部署 10 吉瓦 OpenAI 设计的 AI 加速器。双方将共同开发下一代系统与以太网方案,目标是在 2029 年前支撑可扩展、高能效的 AI 基础设施。
推荐理由:OpenAI 与 Broadcom 的多年合作给出了 10 吉瓦自研加速器的部署规模与 2029 年时间点,可据此观察其算力自研路线。
AMD 与 OpenAI 宣布达成多年期合作,将部署 6 吉瓦 AMD Instinct GPU,用于支撑 OpenAI 的下一代 AI 基础设施。部署从 2026 年的 1 吉瓦起步。
推荐理由:OpenAI 与 AMD 的多年期算力合作给出了分阶段部署规模,可观察其基础设施供应格局的变化。
OpenAI、Oracle 和 SoftBank 宣布为 Stargate 新增五个 AI 数据中心站点,推进一项 500B 美元、10 吉瓦的美国基础设施扩建,用于支撑下一代 AI 并创造数万个就业岗位。
推荐理由:OpenAI、Oracle 与 SoftBank 公布 Stargate 五个新站点,读者可了解这笔 5000 亿美元、10 吉瓦级美国算力基建的推进节奏。
OpenAI 与 NVIDIA 宣布战略合作,将部署 10 吉瓦由 NVIDIA 系统驱动的 AI 数据中心,首期于 2026 年启动。
推荐理由:OpenAI 与 NVIDIA 的 10 吉瓦算力合作给出了首期落地时间,可据此观察大模型训练算力的供给节奏。
OpenAI 与 Oracle 达成协议,将在美国开发 4.5 GW 的额外 Stargate 数据中心容量。OpenAI 称这笔投资将创造就业、加速美国再工业化,并推动美国在 AI 领域的领先地位,同时是 Stargate 这一 AI 基础设施平台的重要里程碑。
推荐理由:OpenAI 与 Oracle 新增 4.5 GW Stargate 数据中心容量的协议,可了解其美国 AI 基础设施布局的规模。
Mistral AI 发布 Mistral Compute,提供从裸金属服务器到全托管 PaaS 的私有集成 AI 基础设施栈,涵盖 GPU、编排、API 与产品服务。
推荐理由:Mistral 把自建训练平台对外产品化,读者可了解欧洲主权 AI 基础设施的一种落地路径。
Mistral 发布企业级 AI 编码助手 Mistral Code,将模型、IDE 插件、本地部署选项和企业工具打包为一体化方案,基于开源项目 Continue 构建,今日面向 JetBrains IDE 和 VSCode 开放私测,正式版计划随后推出。
推荐理由:Mistral 把编码模型、IDE 插件与企业管控打包成可本地部署的方案,读者可据此判断企业级编码助手的落地路径。
OpenAI 宣布推出 Stargate UAE,这是其 AI 基础设施平台 Stargate 的首次国际部署。
推荐理由:OpenAI 公布 Stargate 首次海外落地阿联酋,读者可据此了解其 AI 基础设施的国际化布局。
Mistral AI 发布 Mistral Medium 3,定位兼顾 SOTA 性能与更低成本,定价为每百万 token 输入 0.4 美元、输出 2 美元。
推荐理由:官方给出 Mistral Medium 3 的定价、对标模型与部署门槛,便于判断企业自部署的性价比。
Mistral AI 发布 Le Chat Enterprise,一款由全新 Mistral Medium 3 模型驱动的企业级 AI 助手,包含企业搜索、Agent 构建器、自定义数据与工具连接器、文档库、自定义模型和混合部署等功能,全部功能将在未来两周内陆续上线。
推荐理由:官方披露了 Le Chat Enterprise 的功能清单与部署选项,可据此判断企业级 AI 助手的集成与私有化路径。
Mistral AI 发布光学字符识别 API Mistral OCR,可接收图片和 PDF,按顺序交错输出文本与图像,并已作为 Le Chat 文档理解的默认模型。
推荐理由:官方给出 Mistral OCR 的定价、基准对比与自托管选项,可据此判断多模态文档解析在 RAG 流程中的落地成本。