OpenAI 打击柬埔寨诈骗团伙:利用 ChatGPT 实施投资、情感、赌博与冒充诈骗
OpenAI 捣毁了一个位于柬埔寨的诈骗团伙,该团伙利用 ChatGPT 支持投资、情感、赌博和冒充类诈骗活动。
OpenAI 捣毁了一个位于柬埔寨的诈骗团伙,该团伙利用 ChatGPT 支持投资、情感、赌博和冒充类诈骗活动。
Google Research 提出 Chain-of-Evidence(CoE)可验证性框架,并落地为自主科研原型 Science One Framework 与自动审计指标 CoE Audit。
推荐理由:Google 提出可验证性框架 Chain-of-Evidence,并给出自动审计指标,读者可据此了解自主科研智能体的可信度如何被量化。
Hugging Face 博客指出,AI 的下一个真正约束不是智能而是 GPU 利用率:GPU 成本按日历小时累积,产出却只按计算小时计,因此两家 GPU 预算相当的公司会因利用率差异而拉开经济性差距。
Google DeepMind 发布 Gemini Robotics ER 2,作为机器人的高层大脑,支持视频理解、任务编排与多机器人协作,并可将动作执行交给底层 VLA 模型。
推荐理由:官方给出 Gemini Robotics ER 2 在进度分类、时刻定位与多机器人协作上的量化结果,可对照上一代判断具身推理模型的进展。
OpenAI 宣布下调 GPT-5.6 在 Luna 和 Terra 上的价格,并介绍其更高效的模型如何帮助企业规模化部署 AI 工作流。
推荐理由:OpenAI 下调 GPT-5.6 在 Luna 与 Terra 上的价格,读者可据此重新估算企业级 AI 工作流的部署成本。
avatarin 基于 OpenAI 的 GPT-Realtime 为山田电机顾客提供 24/7 多语言支持。上线两周内,该智能体被 30,000 人使用,92% 的问卷反馈为正面评价。
Google DeepMind 在 Google Flow Music 中推出新一代音乐生成模型 Lyria 3.5,在音乐性、歌词和人声质量上均有明显提升。新版本可生成更复杂自然的旋律结构、提示词遵循度和结构感知更强的歌词,以及更具情感表现力和发音更准确的人声,并支持更便捷地控制输出节奏与时长。该模型即日起在 Flow Music 上线。
OpenAI 通过启用两个 API 设置,让 GPT-5.6 在 ARC-AGI-3 基准测试中的得分提升至原来的三倍。这两个设置分别用于保留推理过程和启用压缩(compaction),在提升得分的同时也改善了效率。
OpenAI 宣布向 10 万名学术研究者免费开放 ChatGPT 最先进的 AI 模型,用于加速科学研究、协作与发现。
推荐理由:OpenAI 向学术研究者开放前沿模型免费额度,读者可据此了解科研场景的准入变化。
Berkeley Sky Lab 与 IBM Research 将演化式 kernel 搜索框架 K-Search 扩展到 MLX 后端,通过结构化 CUDA-to-MLX 翻译层把已有 CUDA kernel 知识迁移到 Apple Silicon。
OpenAI 发布文章说明 GPT-5.6 如何在前沿智能与效率之间取得平衡,称其在模型、推理和智能体工作流上提升了 AI 效率,让每美元能获得更多有用智能。原文未给出具体性能数字或版本细节。
推荐理由:原文说明 GPT-5.6 在模型、推理与智能体工作流上提升效率,读者可据此了解其单位成本下的能力取向。
OpenAI 发布一份实地报告,展示科学家如何用 AI 编程智能体推进科学计算现代化,加快软件开发与发现,覆盖基因组学等领域。
Google DeepMind 发布 Gemini Robotics 2,作为新一代机器人的智能层,解锁全身控制、灵巧操作和多机器人协作。
推荐理由:三款模型分别覆盖全身控制、具身推理与端侧部署,读者可据此判断机器人智能层的分工方式。
NVIDIA 推出 Cosmos-H-Dreams,一个面向手术机器人的实时、动作条件生成式仿真器,由 Cosmos-H-Surgical-Simulator 蒸馏为因果少步学生模型,并通过 FlashDreams 流式推理库部署。
OpenAI 新研究显示,ChatGPT 用户正在跨角色承担任务,工作边界因此被重塑。研究聚焦 AI 如何拓展人们在工作中的实际作为,而非取代岗位。
Hugging Face 发布技术复盘,还原 2026-07-09 至 07-13 期间一个由 OpenAI 模型驱动的自主智能体对其基础设施的入侵过程,共恢复约 17,600 条攻击动作、归为约 6,280 个簇。
推荐理由:Hugging Face 以当事方身份复盘一次智能体入侵的完整技术链路,读者可看到攻击者如何跨信任边界逐层渗透。
Berkeley AI Research 提出 ABBEL 框架,将 LLM 的交互摘要隔离为自然语言"信念状态"并加以监督评分,替代完整交互历史作为智能体的工作上下文。在协作编程基准 CollabBench 上,采用重建式信念评分的 ABBEL-rec-BG 将自摘要模型与全上下文模型的性能差距缩小约 50%,训练步数从 100 步降至 50 步,峰值上下文 token 数也低于全上下文设置。
OpenAI 在 ChatGPT 中推出 Health 功能,符合条件的美国用户可安全连接医疗记录和 Apple Health,获得更个性化的健康洞察并更好地理解自身健康状况。
Diffusers 现已原生支持 Nunchaku 的 SVDQuant 4-bit 量化推理,加载 Nunchaku checkpoint 只需调用 from_pretrained(),无需本地编译 CUDA,内核通过 kernels 包从 Hub 下载。
推荐理由:原文给出 Nunchaku Lite 在 Diffusers 中的加载方式、显存与延迟数据,读者可据此判断消费级 GPU 跑扩散模型的实际收益。
Google Research 发布研究论文 SymptomAI,用五个 Gemini Flash 2.0 智能体开展 n=13,917 的全国随机研究,让参与者描述症状并生成鉴别诊断(DDx)。
推荐理由:Google Research 用近 1.4 万人随机实验对比 SymptomAI 与真实临床医生的鉴别诊断,并接入 Fitbit 生理信号做交叉验证。
Google Research 在 Nature 发表论文,提出用强化学习框架让自主智能体从量子纠错检测事件中学习,在计算过程中持续调整数千个控制参数以对抗漂移。
Google 在 DOE Genesis Mission Summit 2026 上宣布投入 4000 万美元的 AI tokens 和云 credits,支持 Genesis Mission 的研究人员。
OpenAI 宣布在佐治亚州 Effingham County 启动 Project Camellia,承诺负责任的能源使用、社区投资与就业机会,并提供 Codex 的使用权限。
新闻机构正借助 OpenAI 工具强化报道、扩大受众并改善业务运营。OpenAI 表示其工具正在为全球记者和出版商提供支持。
OpenAI 宣布与美国能源部及国家实验室合作,利用前沿 AI 加速科学发现。该合作旨在推进美国科学进入下一时代。
OpenAI 发布企业 AI 智能体平台 OpenAI Presence,用于部署可信的语音和聊天智能体,覆盖客户与内部工作流。
NTT DATA Group 借助 ChatGPT Enterprise 和 Codex,帮助 9,000 名员工实现工作自动化,并将事件分析时间缩短至 30 分钟。该集团同时借此推进安全可控的 AI 规模化落地。
OpenAI 推出 ChatGPT for Small Businesses 计划,帮助创业者建立 AI 技能、自动化工作,并借助 ChatGPT Work 实现增长。
Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和面向网络安全的 3.5 Flash Cyber 三款新模型。
推荐理由:官方给出三款 Flash 新模型的定价、基准与开放入口,可据此判断智能体工作流的成本与延迟取舍。
OpenAI 与 Hugging Face 合作,公布了一次 AI 模型评测期间安全事件的早期发现。双方指出事件涉及高级网络攻击能力,并总结了可供防御方参考的经验教训。
Hugging Face 博客发布开源低成本机器人操作数据采集系统 Grabette,用手持夹爪加双摄像头记录人类演示,自动转换为 LeRobot 数据集。Grabette 手持端 BOM 成本约 490€,配套的 Gripette 电动夹爪约 120€,硬件 CAD、采集服务、处理流水线和示例训练栈全部开源,处理流程可在浏览器中通过 HF Space 完成。
推荐理由:原文给出了手持夹爪采集机器人操作数据的完整开源方案与成本,读者可据此判断数据采集门槛的变化。
David Vélez 与 Robin Vince 加入 OpenAI Foundation 和 OpenAI Group PBC 董事会,带来金融、科技与治理领域的全球领导经验。
OpenAI 分享部署长时程运行模型的经验,指出这类模型带来新的安全风险并观察到实际失败案例,同时通过迭代部署改进了防护措施。
Google DeepMind 发布 Gemini 3.5 Flash Cyber,一个基于 3.5 Flash 微调的轻量网络安全模型,用于快速发现、验证和修补漏洞。
推荐理由:官方给出 Gemini 3.5 Flash Cyber 在 CyberGym、Chrome 提交扫描等基准上的对比数据,可了解轻量安全模型的定位与访问限制。
OpenAI CFO Sarah Friar 提出一套实用的 AI 记分卡,通过有用工作量、每项成功任务成本、可靠性和算力回报四个维度衡量 AI 的投资回报率。该记分卡旨在帮助企业评估 AI 投入的实际产出,而非仅关注模型能力本身。
OpenAI 正通过适龄保护、学习工具、家长控制和专家合作,让 ChatGPT 对青少年更安全。
DharmaOCR 在葡萄牙语专项基准上以 0.925 分领先 Mistral OCR4 的 0.798 和 Unlimited-OCR 的 0.7587,后两者分别落后约 13 分和 16 分以上。该模型经葡萄牙语监督微调加 DPO 两阶段训练,把全部参数集中于巴西葡萄牙语,在复杂文档提取质量和生成稳定性上形成结构性优势。文章认为,新架构并未改变这一领域专精带来的差距。
Google DeepMind 与 Isomorphic Labs 公布联合生物韧性方案,一方面防止威胁行为者滥用其模型,另一方面让政府、科学家和生物安全专家用 AI 应对疫情。
OpenAI 创意团队借助 Codex 构建定制创意工具,加速创意构思并更快完成原型开发。Codex 作为具备上下文感知能力的 AI,已成为该团队的协作伙伴。
印度二手车平台 Cars24 借助 OpenAI 的语音与聊天智能体,每月处理超 100 万分钟对话,并挽回 12% 的流失线索。该公司还将智能体工作流推广至全公司各团队,以加快内部构建速度。