Endava 如何围绕 AI 智能体重构软件交付
Endava 正利用 AI 智能体、ChatGPT Enterprise 和 Codex 加速软件交付并自动化工作流,在企业内部构建 AI 原生文化。
Endava 正利用 AI 智能体、ChatGPT Enterprise 和 Codex 加速软件交付并自动化工作流,在企业内部构建 AI 原生文化。
OpenAI 为 ChatGPT 引入名为 Dreaming 的新记忆系统,用于更好地记住用户偏好,并在多轮对话之间保持上下文的时效性和相关性。
推荐理由:原文给出 ChatGPT 记忆系统的新变化,读者可据此了解跨对话上下文保持方式的调整。
Hugging Face 重构官方命令行工具 hf CLI,使其同时服务人类用户和 Claude Code、Codex、Cursor 等编码智能体,通过环境变量自动识别智能体并切换输出格式。
H Company 发布 Holo3.1 系列 Computer Use Agent 模型,基于 Qwen 家族,覆盖 0.8B、4B、9B 和 35B-A3B 四种尺寸,并首次提供 FP8、Q4 GGUF 和 NVFP4 量化权重。
推荐理由:原文给出跨环境、跨框架与本地量化部署的具体数据,可据此判断端侧 Computer Use Agent 的落地条件。
Travelers 基于 OpenAI 构建了 AI 理赔助手 Claim Assistant,用于引导客户完成理赔申报并提供 24/7 支持。该助手还能在理赔高峰期帮助 Travelers 扩展业务处理能力,目前已在全美范围内部署。
OpenAI 为 Codex 推出插件、站点和标注功能,面向分析师、市场、设计师、投资者等团队。这些新能力旨在帮助不同角色借助 AI 完成更多工作,覆盖各类工具与工作流场景。
JetBrains 发布 Mellum2,一个从零训练、覆盖自然语言与代码的 12B 参数 MoE 模型,每个 token 仅激活 2.5B 参数,以 Apache 2.0 许可开源。官方称其在相近规模模型中基准表现有竞争力,推理速度超过 2 倍,可用于路由、RAG、摘要、子智能体和高吞吐编码场景。模型已在 Hugging Face 提供下载,技术报告发布在 arXiv(2605.31268)。
推荐理由:JetBrains 开源 12B MoE 模型,每 token 仅激活 2.5B 参数,读者可据此判断它在多模型系统中的定位。
Hugging Face 博客提出,企业 AI 规模化落地的关键不在 LLM 本身,而在"Agent 逻辑"——即知识图谱、算法、程序分析库等运行于智能体层的软件原语,可引导 LLM 聚焦企业工作流、压缩上下文空间。
Google Research 在 I/O 2026 发布 Gemini for Science 实验工具套件,包含基于 ERA 与 AlphaEvolve 的 Computational Discovery、基于 Co-Scientist 的 Hypothesis Generation 以及基于 NotebookLM 的 Literature Insights。
Mistral 在 AI Now Summit 2026 上发布面向工业工程的集成 AI 栈,结合物理模型、工程经验与机器人技术,合作方包括 Airbus、BMW 和 ASML,用于加速设计、消除仿真瓶颈并优化资产性能。
推荐理由:Mistral 把工业工程 AI 栈、Vibe 智能体和自建推理数据中心放在一起发布,可看其企业级全栈布局。
Mistral 将 Le Chat 升级为统一 AI 智能体 Vibe,一个许可证同时覆盖工作与编码场景,原有对话、设置和套餐全部保留。
推荐理由:Mistral 把 Le Chat 升级为统一智能体 Vibe,读者可据此了解其工作模式与编码模式的能力边界和定价分层。
Endava 借助 Codex 构建智能体组织,将需求分析周期从数周缩短至数小时,并加速软件交付。
OpenAI、Thrive 和 Crete 用 Codex 构建了一个可自我改进的税务智能体,用于自动完成报税、提升准确率并加速工作流。该智能体面向税务申报场景,将申报流程自动化。
Warp 正押注用 GPT-5.5 及 OpenAI 模型协调本地、云端与开源开发流程中的编码智能体。该工具将编码智能体贯穿这三类工作流,是其在开源方向上的重要投入。
Hugging Face 发布 AI 智能体术语表,重点厘清 harness、scaffold 与 agent 的区别:model 是 LLM 本身,scaffold 是系统提示词、工具描述与上下文管理等行为定义层,harness 则是调用模型、处理工具调用并决定何时停止的执行层。
Google 在 Nature 发表论文介绍 Empirical Research Assistance(ERA),这是一个用 Gemini 编写和优化科学代码的研究工具,通过树搜索在数千种方案中迭代优化代码。
推荐理由:Google 用 Gemini 驱动的 ERA 在 Nature 发表,并给出流行病、径流、CO2 等八篇应用结果,可看科研编码自动化的边界。
OpenAI 与 Dell 达成合作,将 Codex 引入混合云和本地部署环境,让企业能在自有数据与工作流中安全部署 AI 编程智能体。
Google DeepMind 在实验性原型 Project Genie 中上线 Street View 实景锚定能力,用户可选取美国地点并叠加风格与角色描述,生成起始位置对应真实街景影像的交互世界。
推荐理由:原文给出 Genie 接入 Street View 实景锚定的能力与开放范围,读者可据此判断世界模型在智能体与机器人训练上的落地路径。
Google DeepMind 发布 Gemini for Science,包含 Google Labs 上三个实验性工具和 Google Antigravity 中的 Science Skills。
推荐理由:原文给出三类科学实验工具的能力分工与开放入口,可据此判断智能体在科研流程中的落点。
Google DeepMind 与新加坡政府启动国家 AI 合作,在新加坡落地医疗、科研、教育和气候等项目。合作探索 AI co-clinician 辅助诊疗,并用 AlphaFold、Google Earth 加速东南亚疫情研究,同时向中小学至初级学院教育者提供 Gemini for Education。
Google DeepMind 发布 Gemini 3.5 系列首个模型 3.5 Flash,主打智能体与编码能力,即日起在 Gemini app、Google Search 的 AI Mode、Google Antigravity、Gemini API 及 Gemini Enterprise 上线。
推荐理由:Gemini 3.5 Flash 在编码与智能体基准上的表现和速度数据,可供读者判断前沿模型在长程任务上的取舍。
Databricks 将 GPT-5.5 用于企业智能体工作流,此前该模型在 OfficeQA Pro 基准上刷新了 SOTA。
OpenAI 在 ChatGPT 中推出个人财务功能,可连接账户、追踪支出与投资、管理订阅、制定预算并规划财务目标。原文未披露该功能的开放范围与上线时间。
推荐理由:OpenAI 在 ChatGPT 内上线个人财务功能,读者可了解其账户连接与预算管理的能力边界。
Sea Limited 首席产品官宣布在工程团队中全面部署 OpenAI Codex,以加速亚洲地区的 AI 原生软件开发。该部署旨在推动智能体式(agentic)软件开发模式在 Sea 内部的落地。
OpenAI 宣布 Codex 可在 ChatGPT 移动端使用,用户能跨设备和远程环境实时监控、引导并批准编码任务。
Google DeepMind 在 Nature 发表 Co-Scientist 研究,这是一个基于 Gemini 构建的多智能体 AI 系统,可迭代生成、辩论和演化复杂科学问题的新假设。
推荐理由:原文披露了多智能体系统的三阶段协作机制与跨机构验证案例,可了解AI参与科学假设生成的具体路径。
OpenAI 的 Parameter Golf 活动吸引 1000+ 名参与者、收到 2000+ 份提交,探索 AI 辅助机器学习研究、编码智能体、量化与新型模型设计。活动在严格约束条件下进行。
OpenAI 通过沙箱隔离、审批机制、网络策略和智能体原生遥测来安全运行 Codex,以支持安全合规地采用编码智能体。
Parloa 利用 OpenAI 模型打造可扩展的语音驱动 AI 客服智能体,让企业能够设计、模拟并部署可靠的实时交互。
Google DeepMind 回顾了 Gemini 驱动的编码智能体 AlphaEvolve 发布一年来的应用进展,称其已从试点成为 Google 基础设施的核心组件,用于优化下一代 TPU 设计和缓存替换策略。
推荐理由:原文汇总了 AlphaEvolve 在基因组、电网、量子物理和商业客户中的落地数据,可据此判断编码智能体的跨领域适用范围。
OpenAI 的 B2B Signals 研究显示,前沿企业正通过深化 AI 采用、规模化 Codex 驱动的智能体工作流来构建持久的竞争优势。该研究聚焦企业级 AI 落地路径,揭示前沿企业与其余公司之间正在拉大的差距。
Singular Bank 基于 ChatGPT 和 Codex 构建了内部助手 Singularity,帮助银行家每天在会议准备、投资组合分析和后续跟进上节省 60–90 分钟。
OpenAI 与 PwC 达成合作,帮助企业用 AI 智能体自动化财务工作流、改进预测、强化管控并推动 CFO 职能现代化。
Google DeepMind 宣布 AI co-clinician 研究计划,探索 AI 智能体在医生临床监督下协助患者诊疗。
推荐理由:Google DeepMind 公开了 AI co-clinician 的研究设计与评测结果,读者可了解医疗智能体在证据检索和实时多模态问诊上的能力边界。
OpenAI 的 GPT 模型、Codex 和 Managed Agents 现已在 AWS 上可用,企业可在自己的 AWS 环境中构建安全的 AI。原文未披露具体模型版本、上线区域或计费方式。
推荐理由:OpenAI 把 GPT 模型、Codex 和 Managed Agents 放进 AWS 环境,读者可了解企业侧部署路径的变化。
Mistral AI 发布企业 AI 编排层 Workflows 公开预览版,提供持久化执行、可观测性和容错能力,ASML、ABANCA、CMA-CGM、France Travail、La Banque Postale、Moeve 等客户已用它自动化关键流程。
推荐理由:原文给出 Workflows 的编排能力、部署模型与已落地客户案例,读者可据此判断企业级 AI 流程如何从概念验证走向生产。
OpenAI 发布开源规范 Symphony,用于 Codex 编排,可把 issue tracker 变成常驻的智能体系统。该规范旨在提升工程产出并减少上下文切换。
Choco 利用 OpenAI API 构建 AI 智能体,实现食品分销流程自动化,以提升生产力并推动业务增长。这是 OpenAI 发布的一则客户案例,聚焦 AI 在真实业务场景中的落地效果。
DeepSeek 发布 V4,两个 MoE 检查点上线 Hub:DeepSeek-V4-Pro 为 1.6T 总参数、49B 激活,DeepSeek-V4-Flash 为 284B 总参数、13B 激活,均支持 1M token 上下文窗口。
推荐理由:DeepSeek-V4 把长上下文推理成本压到 V3.2 的一成量级,读者可据此判断智能体长任务工作流的可行性。
OpenAI 发布 GPT-5.5,该模型面向编码、研究和数据分析等复杂任务,并支持跨工具使用。
推荐理由:OpenAI 官方发布 GPT-5.5,读者可据此了解新模型面向编码、研究与数据分析的定位。