OpenAI 加入欧盟 AI 行为准则
OpenAI 宣布加入欧盟 Code of Practice,推进负责任 AI,并与欧洲各国政府合作推动创新、基础设施与经济增长。
OpenAI 宣布加入欧盟 Code of Practice,推进负责任 AI,并与欧洲各国政府合作推动创新、基础设施与经济增长。
Mistral AI 与 All Hands AI 合作发布 Devstral Medium,并升级 Devstral Small 1.1。
推荐理由:Mistral 与 All Hands AI 合作发布两款编码智能体模型,读者可据此了解开源编码模型在 SWE-Bench Verified 上的最新位置与定价。
OpenAI 与美国教师联合会(AFT)合作启动一项为期 5 年的计划,为 40 万名 K-12 教育工作者提供支持,帮助他们在课堂中主导 AI 创新。
Mistral AI 推出 AI for Citizens 协作计划,帮助各国政府和公共机构战略性地运用 AI 改造公共服务、推动创新并保障竞争力。该计划提供开放模型、自托管部署、数据主权保障及定制化研发,已与法国、卢森堡、新加坡、荷兰、英国、瑞士等国政府及公共机构合作。
Genspark 借助 GPT-4.1 和 OpenAI Realtime API 构建无代码个人智能体,45 天内做到 3600 万美元 ARR。该产品无需编写代码即可创建智能体,并接入 Realtime API 实现实时交互。
OpenAI 与 Mandala Partners 联合发布面向澳大利亚的 AI 经济蓝图,提出一份可落地的方案,说明澳大利亚如何释放人工智能的经济与社会潜力。该蓝图发布之际,提升生产力已成为澳大利亚的国家优先事项。
Retell AI 推出由 GPT-4o 和 GPT-4.1 驱动的无代码语音自动化平台,企业可借此部署自然、实时的语音智能体,无需脚本或等待即可自动处理客户对话。该平台旨在降低通话成本并提升 CSAT。
Hugging Face 博客宣布 Gemma 3n 已在开源生态中全面开放。
AI GTM 平台 Unify 采用 OpenAI 的 o3、GPT-4.1 和 CUA,将客户挖掘、调研与外联自动化。借助超个性化消息和全天候工作流,Unify 帮助团队规模化生成销售管道,同时聚焦高价值客户互动。
OpenAI 研究了对错误回答的训练如何导致语言模型出现更广泛的失准,并识别出一个驱动该行为的内部特征,该特征可通过极少量微调逆转。材料仅提供摘要,未给出具体方法、模型或实验数据。
OpenAI 正在主动评估先进 AI 在生物学与医学领域的能力,并部署防护措施以防止其被滥用。该公司指出,先进 AI 虽能变革生物学和医学,但也带来生物安全风险。
OpenAI 推出 OpenAI for Government 计划,面向美国公共服务人员提供其最先进的 AI 工具。该计划旨在支持美国政府采用一流技术,并将这些工具用于公共服务。
OpenAI 与 Mattel 达成合作,将 AI 整合进 Barbie、Hot Wheels 等标志性品牌。双方希望借此提升创意开发、简化工作流程,并为粉丝创造新的互动方式。
Mistral AI 发布 Mistral Compute,提供从裸金属服务器到全托管 PaaS 的私有集成 AI 基础设施栈,涵盖 GPU、编排、API 与产品服务。
推荐理由:Mistral 把自建训练平台对外产品化,读者可了解欧洲主权 AI 基础设施的一种落地路径。
Mistral AI 发布首款推理模型 Magistral,分为 24B 参数的开源版 Magistral Small 和企业版 Magistral Medium。
推荐理由:Mistral 首款推理模型同时给出开源权重与企业版,并公开训练与强化学习细节,便于对比其推理路线。
OpenAI 推出对外协调披露政策(Outbound Coordinated Disclosure Policy),用于规范其如何负责任地报告第三方软件中的漏洞。该政策强调诚信、协作与大规模主动安全。
OpenAI 表示正在就《纽约时报》及原告提出的法院命令进行抗辩,该命令要求无限期保留消费者 ChatGPT 和 API 用户数据。OpenAI 称正努力维护用户隐私、满足法律要求,并坚持其数据保护承诺。
推荐理由:OpenAI 与《纽约时报》围绕用户数据留存的法律争议,涉及 ChatGPT 与 API 用户数据的处理边界。
OpenAI 发布最新报告,通过案例研究披露其检测和阻止 AI 恶意使用的方式。报告聚焦 2025 年 6 月发现的滥用行为及应对措施。
Mistral 发布企业级 AI 编码助手 Mistral Code,将模型、IDE 插件、本地部署选项和企业工具打包为一体化方案,基于开源项目 Continue 构建,今日面向 JetBrains IDE 和 VSCode 开放私测,正式版计划随后推出。
推荐理由:Mistral 把编码模型、IDE 插件与企业管控打包成可本地部署的方案,读者可据此判断企业级编码助手的落地路径。
OpenAI 封禁了一批利用 AI 生成批评台湾社交媒体网红及相关美国话题帖子的账号。该行动被命名为“Sneer Review”,涉及中国来源的影响力活动。
OpenAI 封禁了一批利用 AI 在社交平台生成菲律宾政治及公职人员相关评论的账号。这些账号被用于跨平台批量产出政治评论内容。
OpenAI 封禁了与疑似伊朗关联的 STORM-2035 行动相关的账号,该行动利用 AI 生成针对美国、英国、爱尔兰和委内瑞拉政治的影响力内容。
OpenAI 封禁了一批疑似源自俄罗斯的账号,这些账号利用 AI 生成涉及乌克兰、北约及德国国内议题的德语政治内容。
OpenAI 封禁了一批账号,这些账号利用 AI 从事社会工程、监控主题研究以及针对批评者的影响力活动。
OpenAI 封禁了一批中国来源账号,这些账号使用 AI 生成美国政治内容,并研究美国人物、运动和线上社群。
推荐理由:OpenAI 披露封禁一批中国来源账号,读者可了解平台对 AI 生成政治内容与情报搜集的处置口径。
OpenAI 封禁了一批疑似源自柬埔寨的账号,这些账号利用 AI 支持针对英国用户的任务诈骗流程。该行动代号“Wrong Number”,相关账号已被停用。
OpenAI 封禁了一批俄语账号,这些账号利用 AI 构建恶意软件、改进加载器并排查网络工具问题。该行动被命名为 "ScopeCreep",涉及俄语恶意软件开发。
OpenAI 封禁了一批与公开归因于中国的威胁行为者相关的账号,这些账号利用 AI 辅助漏洞研究、脚本编写、翻译和行动排障。
OpenAI 封禁了一批与疑似欺诈就业活动相关的账号,这些账号利用 AI 制作可能用于虚假远程职位申请的材料。
Wix 推出由 OpenAI 提供支持的 AI Website Builder,用户只需在对话中描述自己的想法,就能在几分钟内创建一个完整网站。
Mistral AI 发布首款专为代码设计的嵌入模型 Codestral Embed,在真实代码数据检索任务上优于 Voyage Code 3、Cohere Embed v4.0 和 OpenAI 的大型嵌入模型。
Mistral AI 发布 Agents API,将自家语言模型与代码执行、网页搜索、图像生成、MCP 工具等内置连接器结合,并提供跨对话的持久记忆与智能体编排能力。
推荐理由:原文给出内置连接器、持久记忆与多智能体编排的具体能力,读者可据此判断企业级智能体平台的搭建方式。
Hugging Face 博客发布《Tiny Agents in Python: a MCP-powered agent in ~70 lines of code》,介绍用约 70 行 Python 代码构建一个由 MCP 驱动的智能体。原文正文未能抓取,仅标题可用。
OpenAI 将 Operator 的底层模型从 GPT-4o 替换为基于 OpenAI o3 的版本,API 版本仍基于 4o。该变动作为 OpenAI o3 与 o4-mini 系统卡附录公布。
CodeRabbit 借助 OpenAI 的 o3、o4-mini 和 GPT-4.1 模型改造代码审查流程,提升审查准确率并加快 PR 合并速度。该方案帮助开发者更快交付代码,减少 bug 并提高投资回报率。
OpenAI 宣布推出 Stargate UAE,这是其 AI 基础设施平台 Stargate 的首次国际部署。
推荐理由:OpenAI 公布 Stargate 首次海外落地阿联酋,读者可据此了解其 AI 基础设施的国际化布局。
Mistral AI 与 All Hands AI 合作发布面向软件工程任务的智能体 LLM Devstral,以 Apache 2.0 许可开源。
推荐理由:官方给出 Devstral 在 SWE-Bench Verified 的分数与开源许可,读者可据此判断它能否用于本地或企业代码智能体。
OpenAI 发布 Codex。原文正文未能抓取,仅标题可用。
OpenAI 发布 o3 和 o4-mini 系统卡的补充文件,对象是云端编码智能体 Codex。Codex 由 codex-1 驱动,后者是 OpenAI o3 针对软件工程优化的版本,通过强化学习在多种环境的真实编码任务上训练,目标是生成贴近人类风格和 PR 偏好的代码、精确遵循指令,并反复运行测试直至通过。
Hugging Face Blog 发布 Falcon-Edge 系列,这是一系列强大、通用且可微调的 1.58bit 语言模型。