ARC Prize 2026:ARC-AGI-3 Milestone #2 三位获奖者开源方案
ARC Prize 2026 公布 ARC-AGI-3 Milestone #2 三位获奖者,均开源了各自得分最高的方案。Daniel Franzen 以 27.9% 得分获 $25K,Lord Han Solo 以 23.8% 获 $7.5K,Lohit Siriki 以 22.5% 获 $5K。
ARC Prize 2026 公布 ARC-AGI-3 Milestone #2 三位获奖者,均开源了各自得分最高的方案。Daniel Franzen 以 27.9% 得分获 $25K,Lord Han Solo 以 23.8% 获 $7.5K,Lohit Siriki 以 22.5% 获 $5K。
Viggle Turbo v0.3 发布,这是面向 Qwen-Image-2.1 的加速模型,新增 9-step 模式,细节更精细、小文字渲染更好,颗粒感比 v0.2.1 更少、画面略柔和。该版本已在 ComfyUI 中提供 LoRA 或单文件 int8/fp8/GGUF 形式,模型权重发布于 Hugging Face。
Viggle AI 发布面向 Qwen Image 2.1 的 turbo lora 0.3 版本,@realrebelai 测试后称效果不错。该版本为 LoRA 微调权重,具体参数与可用性未在原文披露。
Viggle AI 公开致谢 Hugging Face 社区,称最精彩的部分是看到大家基于其模型构建的 ComfyUI 工作流、Gradio 演示和 GGUF 量化版本等成果。帖文点名感谢 @cocktailpeanut、@_akhaliq、@linoy_tsaban、@fffiloni、@realrebelai、@drbaph 以及所有参与、分享和二次创作的人。
Google DeepMind 发布 SynthID Bio,这是一组面向 AI 生成生物设计的水印方法,可在不影响生物功能的前提下把不可感知的签名直接嵌入蛋白质序列。该水印类似数字身份证,可帮助 DNA 实验室验证合成蛋白质并保持序列数据库准确,相关工具以开放形式供研究使用。
推荐理由:原文给出 SynthID Bio 的嵌入方式与开放研究入口,读者可据此了解 AI 生物设计溯源的具体做法。
小米 MiMo-V2.6-Pro 和 MiMo-V2.6-Flash 进入 Agent Arena,Pro 在开源模型中排名第 5,在 8.1K+ 真实智能体会话中净提升 +3.17%,较 MiMo-V2.5-Pro 的第 13 名提升 9 位、提高 10.4 个百分点。
推荐理由:Agent Arena 的实测排名与成本数据,可用来对比 MiMo-V2.6 两个版本在真实智能体会话中的表现差异。
开发者正在为 OpenAI Codex Physical Builds 项目构建模块化漫游车 MOSS,从第一天起就支持不同硬件组合。用户可用 Raspberry Pi 5(带或不带 Hailo)或 Jetson,搭配 RealSense 或 Gemini 深度相机,不同组合驱动同一台漫游车。
OpenClaw v2026.9.8 发布,新增 GPT-6.1 Sol 支持,修复 Agent 回复丢失与 Windows 启动问题,并降低内存占用。该版本包含 43 个 PR、8 位贡献者,但 GPT-6.1 Sol 因捆绑的 codex CLI 0.158.0 版本过旧而尚不可用,需 0.160.0 以上版本。
Meta 于周五推出开源项目 Muse Gadgets,提供开源固件和 Linux SDK,让开发者用 Raspberry Pi 或 ESP32 等低成本硬件搭建可连接 Muse 的设备,例如彩色电子墨水屏或插入电视 HDMI 接口的棒状设备,并设有 Discord 频道支持用户。
OpenClaw 已将腾讯混元的 AI-Infra-Guard(AIG)集成进开源命令行工具 ClawScan,后者为 ClawHub 提供安全审查能力。上传到 ClawHub 的每个技能和插件现在都会经过 AIG 审查,并有基准测试和持续反馈机制支撑。
Cohere 与 vLLM 将在多伦多举办一场 meetup,面向 AI 工程师、研究人员和基础设施构建者,报名链接为 luma.com/vllm-y009。活动为晚间聚会,供参与者与 vLLM 社区交流连接。
vLLM 与 Cohere 将在多伦多联合举办 meetup,讨论双方对开源生态的贡献与未来方向。vLLM 的一位核心维护者将分享 vLLM 的下一步规划,NVIDIA AI 工程师则将讲解智能体调试。活动面向开发者开放,可与双方团队现场交流。
Cohere 与 vLLM 将在多伦多举办一场 meetup,面向 AI 工程师、研究人员和基础设施构建者,报名链接为 luma.com/vllm-y009。活动为晚间聚会,供参与者与 vLLM 社区交流连接。
Meta 开源了相关代码,让用户可以自制搭载其新 AI 智能体的 Muse 硬件。Meta 建议的玩法包括把 Muse 装到彩色 E Ink 屏上显示提醒、装到 HDMI 棒上在大屏显示。
Viggle AI 公开致谢 Hugging Face 社区,重点提及社区成员构建的 ComfyUI 工作流、Gradio 演示和 GGUF 量化模型等成果。帖文点名感谢 @cocktailpeanut、@_akhaliq、@linoy_tsaban、@fffiloni、@realrebelai、@drbaph 等贡献者,并感谢所有参与分享与二次创作的人。
Viggle AI 9 月在 HuggingFace 发布 3 个开放权重模型,其中 Viggle-Animate 与 Meridian 获评 Space of the Week。Qwen-Image-2.1-viggle-turbo 位列 trending Space 第 4、trending model 第 9,获 900+ likes、260K+ 下载量,并衍生 50+ 社区 Space。
Perplexity 近期开源了多项贡献,包括 pplx-decider-v1-27b 多模态决策模型,在 11 个基准上平均得分 85.7%,领先 Jev。pplx-embed-v2-context-9b-preview 为上下文嵌入向量模型,在 ConTEB 和 turbopuffer context-bench 上表现最佳。
Muse 宣布推出 Muse Gadgets 与 Muse Home Link。Muse Gadgets 是开源 ESP32 固件和 Linux SDK,供开发者制作可与 Muse 配合的硬件;Muse Home Link 是让 Muse 连接电视、音箱等智能设备的硬件,用户可在官网认领。
Meta 研究博客发布《Solving Open Research Problems Together》,介绍数学家与 Muse Spark 合作完成六篇研究论文。该内容为 AI at Meta 转推并附上研究博客链接。
Cloudflare 发布 Clef 和 Clef-flash 两款面向 AI 智能体的决策模型,返回带概率的简短分类而非长文本,用于路由工单、触发升级或转交人工。
Keras 社区会议公布可插拔后端计划,MLX 和 PaddlePaddle 后端即将推出,新后端将以附加库形式安装。Keras 将减少新后端所需的算子数量,为所有次要算子添加后端无关实现,并统一新算子的单元测试工具,单个测试框架即可验证类型转换一致性等功能。KerasHub 新增大量模型,并将从 tf-text 预处理迁移至 PyGrain。
Sigil 宣布推出运行在用户自有设备上的私人 AI 产品 Underdog,并获得 a16z、Khosla Ventures、Hummingbird VC 及 Anthropic 相关基金 Anthology 等投资。
Keras 社区会议将于本周五 10 月 2 日上午 10 点(PST)举行,介绍 Keras 生态系统的最新进展,任何人都可参加,通过 meet.google.com/gva-bbpr-twe 加入。
Trillium Labs 今日亮相,是一家推动前沿 AI 开放科学的新非营利组织,将构建开放的后训练配方,并扩展至开放基础设施,研究 RSI、奖励黑客与多智能体系统。该组织由 Nathan Lambert 与 Tom Zick 共同创立,已获 Halcyon Futures 和 Schmidt Sciences 初始支持,正在招聘全职与学生合作者并筹集算力。
Trillium Labs 作为一家新非营利组织正式亮相,致力于推动前沿 AI 的开放科学,将构建开放的后训练配方并扩展至开放基础设施,研究 RSI、reward-hacking 和多智能体系统。
SETA(Scaling Environments for Terminal Agents)被 NeurIPS 2026 Evaluations & Datasets Track 接收,并发布 SETA-Env 数据集,包含 4500+ 个开源可验证终端 RL 环境及完整的合成与训练管线。
Black Forest Labs 发布 Flux 3 模型家族中的图像模型 Flux 3 Image,官方称其支持多步编辑而不改动图像其他部分,覆盖文生图、图生图、文字渲染和照片级真实感。
小米 MiMo-V2.6-Pro 和 MiMo-V2.6-Flash 登陆 Agent Arena,Pro 在 8.1K+ 真实智能体会话中净提升 +3.17%,位列开源模型第 5,较 MiMo-V2.5-Pro 的第 13 名提升 9 位、净提升提高 10.4 个百分点。
推荐理由:榜单给出了 MiMo-V2.6 两款模型在真实智能体会话中的排名与成本对比,可据此判断开源模型在 Agent 场景的位置。
一位新加入 Mistral AI 的成员宣布将在蒙特利尔及加拿大各地组建团队,推进安全、强大且开放的前沿 LLM。其职责还包括搭建 Mistral 与麦吉尔大学、Mila_Quebec 及加拿大 AI 生态的桥梁,并正面向 LLM 全栈各层级招聘。
Runway 机器人负责人 Andy Chen 介绍了公司在机器人方向的技术路线,并首次公开开源世界动作模型 Praxis-1。官方同时开放 Praxis-1 的早期访问申请,详情见 runway.com/praxis-1。
Hugging Face Open Together 活动将于 10 月 16 日在旧金山 Midway 举办,报名链接为 luma.com/OpenTogether。
Runway 发布 Praxis-1,一个开放权重的 World Action Model,把其视频预训练能力用于机器人的真实世界控制。该模型基于 Runway 的大规模视频预训练和实时基础设施构建,定位为面向机器人开发者和研究者的策略模型,可适配任意形态和环境。
Unsloth 与 HuggingFace 联合举办开源派对,现场将发放 Unsloth 周边并展示其即将推出的新功能。活动包含 demo、DJ 和餐饮,报名地址为 luma.com/OpenTogether,使用优惠码 NOSLOTHSHERE 可入场。
OpenAI 在 DevDay 2026 上发布 Dots 常驻智能体、GPT-6.1 Sol、Ultrafast 模式、Decisions API、ChatGPT Spaces 与 Marketplace,并称 ChatGPT 周活达 12 亿。
推荐理由:汇总了 OpenAI DevDay 2026 的发布清单与第三方评测数据,可快速了解各家模型在成本与能力上的相对位置。
Audio8 ASR Infinite 是一款原生流式语音识别模型,每秒解码 12.5 次,通过滚动 KV Cache 让内存与延迟在 24/7 持续运行下保持恒定。模型每个时钟步输出一个文本 token,支持 12.5 / 8.3 / 6.25 次每秒的决策频率,以平衡感知粒度与资源开销。模型已在 Hugging Face 开源,并提供 Gradio 工作流与 HuggingChat 试用入口。
Hugging Face 发布 Open TTS Leaderboard,用客观指标评测开源多语言 TTS 与声音克隆模型,单模型评测耗时从数周投票缩短到数小时。
Hugging Face 联合创始人 Clement Delangue 表示,被 NVIDIA 收购后,公司可以招到作为小创业公司时招不到的人,并给他们十年时间让开源 AI 胜出。他同时公开邀请符合这一目标的人通过私信联系他。
NVIDIA 发布开源表格基础模型 Kumo Tabular,给定带标签的表格行即可在单次前向传播中预测新行标签,无需训练、调参和特征工程,同时支持分类与回归。
推荐理由:原文给出模型规模、训练数据来源与四个基准排名,可据此判断表格基础模型相对梯度提升树路线的差异。
Latent Space 的 AINews 汇总 9/24-9/25 动态,指出 Opus 5.5 本周发布后在讲解视频生成上表现突出,SimpleBench 达 88.4%,被 @skalskip92 评为 Anthropic 迄今最强视觉模型。
吴恩达宣布其开源智能体框架 OpenWorker 将基于 NVIDIA OpenShell,支持在沙箱内运行每个智能体的命令,默认无法访问密钥、浏览器登录凭据和任意网站。