OpenAI 封禁俄罗斯来源账号,其利用 AI 推广虚假智库与主权指数
OpenAI 封禁了一批俄罗斯来源账号,这些账号利用 AI 推广一个虚构的以色列智库以及一个赞扬俄罗斯、批评西方的“主权”指数。
OpenAI 封禁了一批俄罗斯来源账号,这些账号利用 AI 推广一个虚构的以色列智库以及一个赞扬俄罗斯、批评西方的“主权”指数。
OpenAI 为 ChatGPT Work 和 Codex 推出 Admin 插件,用于分析工作区用量、管理成员与权限、调整限额并处理管理请求。
Mistral 与 HUMAIN 宣布战略合作,覆盖 AI 基础设施、先进模型开发与 AI 解决方案部署,初期聚焦网络安全和语音,并计划开发阿拉伯语表现强劲的前沿模型,合作规模达数亿欧元。Mistral 将探索使用 HUMAIN 数据中心基础设施,双方还计划在沙特面向受监管行业制定联合市场策略,以满足对主权 AI 的需求。
GPT-5.6 现已在 Kiro 中可用,帮助开发者完成软件的规划、构建、审查与测试,并带来更好的性价比。
Google 发布 Biomarker Discovery Framework,一个多智能体系统,将候选生物标志物优先级排序构建为人类监督下的迭代研究闭环,结合假设生成、并行统计分析、模型训练、对抗验证与文献推理。
Google DeepMind 回顾了 15 年游戏 AI 研究历程,从 DQN 直接以原始像素玩 49 款 Atari 游戏,到 AlphaGo、AlphaZero、MuZero 和 AlphaStar 在围棋、国际象棋与 StarCraft II 上接连突破。
Google Research 提出 Mobility-Embedded POIs(ME-POIs)框架,将匿名化移动性模式与文本描述结合,为地点生成同时编码身份与动态功能的嵌入向量。
Hugging Face 发布研究,用共识分歧、掩蔽实体检索和拼写切换三项探针量化语音识别中的基准优化现象,评测 11 个开源 ASR 模型。结果显示,部分高分模型会在音频与参考文本矛盾时复现基准的错误转写,VoxPopuli 分析样本中约 40% 的片段被标记出参考错误,涉及约 3% 的参考词,这类模型复现错误参考的比例为 18–30%。
推荐理由:通过三项探针量化语音模型对基准的过拟合,并给出可复用的检测脚本与榜单入口。
Papers with Code 的混合搜索系统用 Hugging Face Jobs 做全量论文嵌入、Storage Buckets 做持久化中转、Inference Endpoints 提供在线查询的低延迟嵌入,目前维护超过 11 万篇来自 arXiv 和 Daily Papers 的论文嵌入。
Liquid AI 为 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 草稿模型检查点,通过投机解码在 GPU 上最高提升 3.18 倍吞吐、端侧最高 2.87 倍,且不改变输出质量。
推荐理由:Liquid AI 给出三款 LFM2.5 草稿模型的实测吞吐与函数调用延迟数据,可据此判断端侧推理的可用性。
微软研究院发布深度学习交换关联泛函 Skala 1.1,训练数据量为此前首个公开版本的 2.5 倍,在 GMTKN55 的 55 个类别中 32 项排名第一,加权平均误差 2.8 kcal/mol。Skala 现已在 CP2K 中可用,并正被集成进 Psi4、FHI-aims、ORCA 和 VASP,同时微软研究院推出持续追踪各版本计算性能的 living benchmark。
Mistral 发布 Agentic Search,一种面向企业复杂文档的多步检索层,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries 中。
推荐理由:原文给出多步检索循环的工具设计与两组基准数字,读者可据此判断它相对一次性 RAG 的取舍。
OpenAI 推出新博客 Intelligence Age,探讨变革性 AI 可能如何重塑权力、治理、经济与个人自由。
Stampli 借助 Codex 和 ChatGPT Work,把原本需要数周的发布物料制作压缩到几天,发布工时减少 68%。在截止日期固定、设计资源被占用的情况下,该公司用这套组合完成了上线生产。
OpenAI 重申面向符合条件的 API 客户提供零数据保留(Zero Data Retention),并预览 Private Safety Processing,可在不牺牲数据隐私的前提下实现高级 AI 安全处理。
Replit 推出 Free Mode,由 GPT-5.6 Luna 驱动,让任何人都能把想法变成可运行的软件,无需担心 token 成本。
OpenAI 宣布 ChatGPT Ads 扩展至 31 个欧洲市场。官方称广告主可在用户探索、比较选项和做决策的过程中触达他们。
OpenAI 发起一项新计划,旨在加强国家安全领域 AI 的民主监督,通过工具、培训和专业知识支持政府机构。
IBM Research 在 Hugging Face 博客发布 ALTK-Evolve 研究,用 AppWorld 的 585 个多步任务评测八款模型,发现智能体记忆不是开关而是需要按模型校准的剂量。
推荐理由:八模型对比给出了智能体记忆的三种剂量模式与 token 开销数据,可据此判断自家模型该用全量还是检索式注入。
OpenAI 推出 ChatGPT for Teens,帮助青少年学习、批判性思考并自信使用 AI。该版本内置更强的保护机制、健康使用功能,并为家长提供额外控制选项。
OpenAI 与 CodeAI 达成合作,帮助学生建立 AI 素养、批判性思考 AI,并培养负责任地使用和塑造 AI 的技能。
OpenAI 正在为前沿 AI 模型加强监控、对齐与安全防护,并称新的保障措施正在引导模型开发的节奏。原文未披露具体模型版本、参数规模或评测数据。
Asana 借助 OpenAI Codex 在两周内替换了陈旧的测试系统,模型与基础设施成本约 1.2 万美元。这项原本预计耗时数年的代码迁移由此大幅提速。
Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,用于 ColBERT 式后期交互检索,PyLate、Stanford-NLP ColBERT 检查点可直接加载,colpali-engine 的视觉文档检索模型也可通过同一 API 使用。
推荐理由:原文给出多向量编码器的加载、打分与索引接入方式,读者可据此判断现有检索栈的改造量。
NVIDIA 团队使用 ChatGPT Work 减少手动任务、连接快速变化的信号,并将成功的工作流扩展到全球范围。
Hugging Face 构建了约束感知的 GPU 分配器,在相同硬件和负载下对比 FIFO 调度器,七个基准场景中 GPU 利用率最高提升 33 个百分点,优先级加权产出最高提升 105%。在五个真实争用场景中,利用率从 52–85% 提升至 72–88%,优先级加权价值平均提升 52%。核心变化不在硬件,而在于分配决策的顺序:实时推理按需求曲线逐时间步分配,批式任务按优先级跨整个调度周期排布。
Google 推出 PhotoScan,一个可从普通 2D 手机照片估算体脂率(BF%)、Android-to-Gynoid 脂肪比(A/G)和内脏-皮下脂肪面积比(V/S)的深度学习框架。
OpenAI 发文阐述 AI 正在同时重塑攻防两端的网络安全格局,并介绍其自身如何强化防御体系。文章同时面向安全团队给出当下可采取的行动建议。
OpenAI 宣布加入 PORTS-Pike 项目,扩大社区投资并支持俄亥俄州南部数千个就业岗位。
OpenAI 资助 14 个独立项目,探索在 Intelligence Age 扩大经济机会、增强社会韧性的新 AI 政策思路。
Hugging Face 发布 2026 年 1 月至 8 月的开源模型生态观察报告,模型仓库从 243 万增至 296 万,数据集从 71.1 万增至 100 万,Spaces 从 100 万增至 144 万。
推荐理由:Hugging Face 用 Hub 七个月的数据拆解开源模型格局,读者可据此理解下载量与点赞为何指向不同事实。
AWS 开源 SDK Strands Robots(Apache 2.0)演示了机器人数据闭环:用 Robot("so100") 录制 LeRobotDataset 并同步到 Hugging Face Storage Buckets。
Google DeepMind 发布 Gemini 3.7 Flash,称其为面向编码和智能体最强的主力模型,距 Gemini 3.6 Flash 发布仅三周。
推荐理由:官方给出 3.7 Flash 在编码、文档与业务工作流上的基准对比和限时定价,可据此评估升级与成本。
OpenAI 发布 GPT-5.6 构建者指南,介绍初创公司如何借助更智能的模型选择与 Responses API 新能力,构建更快、更具成本效益的 AI 智能体。
OpenAI 预览新的 API 服务层级 Ultrafast,运行 GPT-5.6 Sol 时最高可提速 14 倍。该服务由 Cerebras 提供支持,输出速度最高可达每秒 750 个 token。
OpenAI 任命 Dali Rajic 为首席营收官,负责领导其全球营收组织,帮助企业在 AI 上实现完整价值。
Hugging Face 在 7 月 15 日至 8 月 2 日举办 ICML 2026 开放复现挑战,1221 名社区成员用 Claude Code、Codex、Cursor 等编码智能体逐条复现论文,共发布 6816 份 Trackio logbook,覆盖 2226 篇论文,占全部录用论文的 34%。
推荐理由:Hugging Face 公开了 2200 余篇 ICML 论文的复现结果与判定数据,可据此了解智能体参与科研复现的可行边界。
Hugging Face 的 OlmoEarth Studio 现已支持计算并导出嵌入向量,用户可通过 UI 或 API 选择区域、时段、编码器变体和影像源,获得 Cloud-Optimized GeoTIFF 格式结果。
微软研究院推出 MindTopo 基准,用于评测多模态大模型在连通性、封闭、顺序、分离与打结五类拓扑关系上的推理与规划能力。测试显示,模型在静态图像识别上表现明显优于交互式规划任务,且两者均远低于人类水平;失败多发生在规划阶段而非感知阶段,模型在场景变化中会丢失结构关系或提出违反物理约束的动作。图像与视频生成仅在单帧关系可见时偶有帮助,序列任务中仍不可靠。
Google DeepMind 发布多语言手语转文本模型 SL2T,首次将手语 AI 带入消费级产品,在 Pixel 11 的 Gboard 和 Live Transcribe 中支持美国手语(ASL)转英文听写。
推荐理由:SL2T 把多语言手语翻译从实验室带进 Gboard 与 Live Transcribe,读者可了解其数据规模与端侧隐私设计。