推荐理由:原文同时给出三个智能体的定位、跑分和开放基准套件入口,读者可据此评估其在移动端任务上的实际水平。
#开源生态
#开源生态
Alibaba_Qwen@Alibaba_Qwen精选AI 评分 TheInclusionAI@TheInclusionAIAI 评分 NVIDIA BlogAI 评分
NVIDIA 与合作伙伴在新加坡 AI Day 展示东南亚 AI 进展
NVIDIA 在新加坡 AI Day 上联合合作伙伴展示东南亚区域的 AI 落地进展,新加坡 HTX 正研究使用 NVIDIA Nemotron 3 Super 与 Nemotron 3 Nano Omni 模型推进公共安全 AI。
AntLingAGI@AntLingAGIAI 评分 AntLingAGI@AntLingAGIAI 评分 UnslothAI@UnslothAIAI 评分
NVIDIA Blog精选AI 评分
NVIDIA 发布 Isaac ROS 5.0,为机器人开发引入智能体工作流
NVIDIA 在加拿大多伦多 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速软件包集合,新增智能体工作流与平台支持,支持 ROS Lyrical 和 Ubuntu 24.04。
推荐理由:Isaac ROS 5.0 把智能体工作流引入机器人开发,并给出可复用的技能与生态伙伴落地案例。
Latent Space精选AI 评分小米发布 MiMo-V2.6-Pro 与 Flash 开源全模态模型,训练成本约 300 万美元
小米发布 MiMo-V2.6 系列开源全模态模型,其中 MiMo-V2.6-Pro 为 1.02T 总参数、42B 激活参数,Artificial Analysis 称其以 46 分登顶开源权重模型智能指数,输入输出价格分别为 $0.435/M 和 $0.87/M tokens,采用 MIT 许可。
推荐理由:小米首次进入前沿开源模型序列,文中给出参数规模、训练成本与开源范围,可据此判断开源权重竞争的新格局。
Hugging Face Blog精选AI 评分
Transformers 支持直接运行 llama.cpp 的 GGUF 量化模型
Hugging Face 为 transformers 加入 GGUF 支持,可直接用 from_pretrained 加载 Hub 上的量化 checkpoint 并在本地生成,目前聚焦 Apple Silicon 与 Qwen3.5 架构。
推荐理由:原文给出在 transformers 中直接加载 GGUF 的用法与 Apple Silicon 上的实测对比,可据此判断本地推理工作流是否值得迁移。
Hugging Face BlogAI 评分
oMLX 作者 Jun Kim 加入 Hugging Face,支持 MLX 社区
oMLX 创作者兼维护者 Jun Kim 加入 Hugging Face,全职投入 MLX 社区建设。oMLX 将保持 Apache 2.0 开源协议并由 Jun 继续领导,从副业项目转为有资金支持的长期项目,以获得更好的稳定性和更快的开发速度。Hugging Face 希望 oMLX 成为新想法的试验场,并推动 transformers 模型定义快速转化为可供不同引擎使用的 MLX 参考实现。
NVIDIA BlogAI 评分
NVIDIA 埃及 AI 生态从赋能走向规模化落地
NVIDIA 在埃及大埃及博物馆举办 AI 生态活动,埃及的 NVIDIA Deep Learning Institute 学员规模一年内增长超十倍。Hassan Allam Utilities 与 A15 将开发新数据中心,投资约 4 亿美元;Cassava 与 Vodafone Egypt 宣布 AI factory 计划,通过 GPU-as-a-service 提供本地托管 AI 基础设施。
Hailuo_AI@Hailuo_AIAI 评分 Alibaba_Qwen@Alibaba_QwenAI 评分 Qwen 官方宣布 SGLang-Diffusion 已支持 Qwen-Image-2.1,提供文生图、多图编辑和透明 RGBA 输出能力,可直接试用。
Hugging Face BlogAI 评分
Hugging Face tokenizers v1:编码、解码与实测扩展性
Hugging Face 发布 tokenizers v1 候选版,输出与 v0.23 完全一致的 token ID,但速度常快数十倍。v1 将单个 crate 拆为 workspace,用 bitcannon 以 SIMD 位流替代正则做预分词,并引入无分配 merge 循环、线程本地 word cache 和原生多线程并行。
Alibaba_Qwen@Alibaba_QwenAI 评分 Alibaba_Qwen@Alibaba_Qwen精选AI 评分 Qwen 官方宣布 Qwen-Image-2.1 开放权重,称其为 Qwen-Image 系列中最均衡、最具性价比的模型,采用统一架构同时支持生成与编辑。
推荐理由:原文列出了架构规模、透明度与编辑能力等具体变化,读者可据此判断它对现有图像工作流的替代空间。
GitHub Blog · AI & MLAI 评分GitHub Podcast 拆解五大 AI 热梗:该不该读 AI 代码、RAG 已死、Skills 杀死 MCP?
GitHub Podcast 最新一期逐条拆解了五个 AI 热梗:AI 生成的代码仍需人来负责,只是审查力度应按风险分级;Skills 与 MCP 解决的是不同问题,前者是打包好的经验,后者是连接工具与数据的标准;RAG 并未消亡,它让模型从训练数据之外获取文档、内部知识和代码库上下文,检索不佳会浪费 token、拖慢速度并增加答案不完整的概率。
sherwinwu@sherwinwuAI 评分 AnthropicAI@AnthropicAIAI 评分
X:商汤 SenseTime (@SenseTime_AI)精选AI 评分 商汤发布 SenseNova U1.5 技术报告:开源 8B-MoT 原生统一模型
商汤发布 SenseNova U1.5 技术报告,推出开源 8B-MoT 原生统一模型,通过共享注意力连接理解与生成。模型采用 Pixel Shuffle 加 3×3 空间卷积实现原生 4K 生成,并用多专家在线策略蒸馏整合美学、OCR、信息图与编辑能力。
推荐理由:技术报告与训练配方同步开源,读者可据此了解统一多模态模型如何打通理解与生成。
itsPaulAi@itsPaulAiAI 评分
Mistral AIAI 评分
Mistral 与 Mozilla 合作,为 Firefox 浏览器带来开放、私密的多语言 AI
Mistral 与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)现由 Mistral 模型驱动,率先面向法国和北美用户,英国和德国预计今年晚些时候跟进。双方称对话默认不保存在 Mozilla 服务器上,Mistral 同意零数据保留,并按地区语言、方言和文化语境微调模型。
Meituan_LongCat@Meituan_LongCatAI 评分 mehulmpt@mehulmptAI 评分
PatrickToulme@PatrickToulmeAI 评分 Mistral AIAI 评分
Cloudera 与 Mistral 达成合作,将主权 AI 引入企业数据平台
Mistral 与 Cloudera 达成合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持控制权。企业还能在受控环境中用专有数据训练自有模型,基于开放权重拥有数据和由此产生的智能。Cloudera 平台上客户管理的数据规模达 30 exabytes。
Hugging Face BlogAI 评分
Hugging Face Jobs 上用 LoRA 实现异步 GRPO:一个 Bucket、一个代理,无需 NCCL
TRL v1.14 的 AsyncGRPOTrainer 现已支持只训练并同步 LoRA adapter 到 vLLM,rank-1 adapter 仅几 MB,可通过挂载在三个 HF Jobs 上的 Storage Bucket 传输,无需 NCCL。
Hugging Face Blog精选AI 评分
Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111 图像管线
Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张包含 11 条媒体管线和 73 个节点的画布,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 与图生视频。
推荐理由:原文完整拆解了 73 节点画布如何复刻 A1111 的十一类图像管线,可据此迁移到自建多模型工作流。
X:商汤 SenseTime (@SenseTime_AI)AI 评分 商汤 SenseNova-Skills 开源技能套件:让 AI 智能体具备端到端办公能力
商汤发布开源技能套件 SenseNova-Skills,让 AI 智能体具备从原始研究与数据分析到可编辑 PPT 演示文稿和信息图表的端到端办公能力。该套件已由 AiZen Tools 完成测试,并随 Hermes Agent 与 OpenClaw 捆绑提供快速安装方式。
Google DeepMind精选AI 评分Google DeepMind 发布 AlphaGenome Atlas,覆盖人类基因组 90 亿个单核苷酸变异预测
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,超过 AlphaFold Database 的 30 倍。
推荐理由:读者可了解 AlphaGenome Atlas 如何把 90 亿个单核苷酸变异的预测结果做成可检索资源,以及 AVI 评分在编码与非编码区的用途。
ClementDelangue@ClementDelangueAI 评分 为 Mistral 鼓掌! 看到他们表现如此出色真是太好了,他们是所有人的榜样,因为世界各地都需要更多主权和开源 AI。 很期待继续在 huggingface.co/mistralai 上支持他们!
Mistral AI精选AI 评分
Mistral 完成 30 亿欧元 D 轮融资,估值超 210 亿欧元
Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,由三星电子领投,Scaleup Europe Fund 与 PSG Equity 共同领投。
推荐理由:Mistral 完成 30 亿欧元 D 轮融资,读者可借此了解欧洲主权 AI 路线获得的资本与产业支持。
HBX_hbx@HBX_hbxAI 评分
UnslothAI@UnslothAIAI 评分 sundarpichai@sundarpichaiAI 评分 恭喜 @JensenHuang @ClementDelangue 取得这一重大成果!我们曾是 HuggingFace 的投资人,至今仍是合作伙伴,这将壮大开源模型生态!
Google Research精选AI 评分Google Research 与 HHMI Janelia 发布雄性果蝇完整脑图谱
Google Research 与 HHMI Janelia 等机构在 Cell 发表雄性果蝇完整中枢神经系统连接组,包含超过 166,000 个神经元和 1.25 亿个突触连接,是迄今神经元数量最多的脑图谱。
推荐理由:读者可了解AI驱动的连接组学如何完成迄今神经元数量最多的脑图谱,以及它向脊椎动物扩展的路径。
Hugging Face BlogAI 评分
Hugging Face 推出 NeoMME:高效多模态多语言编码器
Hugging Face 发布 NeoMME 系列多语言多模态编码器,含 260M 和 800M 两个版本,用单个双向 Transformer 直接处理文本 token 与原始图像 patch,无需独立视觉塔或因果语言模型,并以掩码离散扩散目标从零训练。
JensenHuang@JensenHuangAI 评分 Hugging Face BlogAI 评分
用 TRL 和 OpenEnv 训练编程模型画水彩
Hugging Face 博主用 TRL 和 OpenEnv 复现了 Surya Narreddi 让语言模型画水彩的思路,模型通过 p5.brush 写出约 150 行 JavaScript 作画,全部数据集、RL 环境、训练脚本与模型均已开源。