Amazon Bedrock AgentCore payments 支持 AI 智能体按次付费购买模型推理
Amazon Bedrock AgentCore payments 让 AI 智能体通过 x402 协议按请求付费购买模型推理,支出限额由基础设施层强制执行而非模型控制。
Amazon Bedrock AgentCore payments 让 AI 智能体通过 x402 协议按请求付费购买模型推理,支出限额由基础设施层强制执行而非模型控制。
AWS 展示了如何用 Amazon Bedrock AgentCore、Amazon Bedrock Knowledge Bases 和 Amazon Nova Sonic 为航司应用构建语音旅行礼宾服务,支持用户通过语音查询行程、改选座位、更新餐食偏好与回答政策问题。
AWS 介绍了通过 SageMaker Unified Studio 管理 SageMaker HyperPod 集群并保留治理控制的最佳实践,覆盖组织、项目、集群、工作负载四层控制。
Amazon SageMaker AI 优化生成式 AI 推理推出 aws-ai-ml skill,通过 Agent Toolkit for AWS 提供给 Kiro、Claude Code、Codex 等编码智能体,也可用于任何支持 MCP 的智能体。
AWS 介绍如何用 Amazon Bedrock AgentCore Evaluations 评估多智能体系统的可解释性与有用性,该能力同时支持内置评估器(helpfulness、task success、instruction following)和自定义评估器,可校验约束满足、路线可行性、SQL 正确性、库存 grounding 与解释质量。
AWS 推出 Quick Resource Migrator,一个托管在 Amazon Bedrock AgentCore 上的 MCP server,可在单次工具调用中将 Amazon Quick 的 chat agents、action connectors、knowledge bases、flows 和 spaces 自动迁移到生产 AWS 账号。
微软 Copilot Studio 团队与 Hugging Face 联合发布 ThinkingBox,通过隔离的 MCP 工具会话运行智能体,按终端后端状态和副作用而非生成文本打分,覆盖 507 个有状态业务流程、每个任务重复运行 20 次。
推荐理由:微软与 Hugging Face 联合发布的智能体评测基准,用 507 个有状态工作流和 20 次重复运行,把工具调用成功率与数据库终态正确率区分开来。
AWS 提出 Adjudicated Query 设计模式,让业务用户在 Amazon Quick 聊天界面提问合规问题,实际判定交由确定性规则引擎完成,模型只负责把自然语言翻译成固定类型操作并叙述结果。
通过 Amazon Bedrock AgentCore Gateway,可将 Claude Desktop 接入由 Amazon 网页索引支持的 Web Search,覆盖数百亿文档,查询流量全程留在 AWS 内,无需外部 API key。
AWS Professional Services 用 Strands Agents SDK 在 Amazon Bedrock AgentCore 上构建四智能体模式,将每应用 IaC 开发时间从 3 到 4 周缩短至分钟级。
AWS 介绍如何在 Amazon Bedrock AgentCore 上构建环境智能体(ambient agent):S3 或定时事件触发后,AgentCore Runtime 上的智能体自动分析文件并生成任务,需要时通过单个 ask_human 工具暂停等待人工审批,再从中断处恢复。
AWS 为 Amazon Bedrock AgentCore 推出 Runtime Instances,用托管 EC2 承载长时间运行的多智能体工作流,会话最长 14 天、支持 GPU 和持久卷,单实例可托管多个智能体。
Amazon Quick 各组件对提示词的解析方式不同,需按组件分别设计。Quick Research 要求明确目标、受众与关注范围,并可从 Quick Index。
Hugging Face 博客介绍论文 ProvenanceGuard,一个面向 MCP 智能体的生成后验证层,专门检测"跨来源混淆"——即事实在证据池中为真、却被归给错误来源。在 281 条医疗智能体真实 trace 上,专家判定 361 条 claim 中 139 条不应通过,ProvenanceGuard 拦下 138 条,并在可识别来源的 claim 上约 86% 选对来源。
H公司发布 Holo4 系列智能体模型,包含 27B dense 与 35B-A3B Mixture of Experts 两个版本,均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 形式开源在 Hugging Face,同时发布 Holotron4 Nano。
推荐理由:Holo4 同时覆盖 GUI、代码、MCP 与 API 四种接口,并公开全部评测轨迹,可据此判断通用计算机操作智能体的路线取舍。
GitHub Copilot 应用中的 canvas(画布扩展)是一种可自定义界面,用户只需在 agent 会话中输入 /create-canvas 并用自然语言描述需求,即可生成看板、发布清单或仪表盘等界面,无需编写代码或手动设计。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指定 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做定级并生成漏洞报告。
推荐理由:原文完整披露了 Fuzzing Taskflow 的流水线分层、覆盖反馈循环与崩溃定级机制,可据此判断 LLM 智能体在安全测试中的可迁移边界。
GitHub Podcast 最新一期逐条拆解了五个 AI 热梗:AI 生成的代码仍需人来负责,只是审查力度应按风险分级;Skills 与 MCP 解决的是不同问题,前者是打包好的经验,后者是连接工具与数据的标准;RAG 并未消亡,它让模型从训练数据之外获取文档、内部知识和代码库上下文,检索不佳会浪费 token、拖慢速度并增加答案不完整的概率。
Google Research 在 ACL 2026 提出 ToolGrad,用“先答案后问题”范式生成工具调用数据:先迭代构建可验证的 API 工作流,再反向标注用户查询,数据生成通过率接近 100%。
Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张包含 11 条媒体管线和 73 个节点的画布,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 与图生视频。
推荐理由:原文完整拆解了 73 节点画布如何复刻 A1111 的十一类图像管线,可据此迁移到自建多模型工作流。
OpenAI 发布 Agents API,这是一个由 Codex harness 驱动的托管服务,用于构建和上线云端智能体。该服务支持编排、长时间运行的会话以及工具调用。
推荐理由:官方给出 Agents API 的托管定位与 Codex harness 编排能力,可据此判断云端智能体的搭建方式。
Hugging Face 发布 funes,一个面向 Claude Code、Codex、pi 和 Hermes 的持久记忆层,从本机已有会话构建索引,一条命令即可接入。
推荐理由:原文给出了跨 Claude Code、Codex 等智能体的本地记忆层设计与安装方式,读者可据此判断它能否替代会话压缩和手写交接。
Gradio 内置的 gr.Workflow 把 AI 流水线变成图结构界面,用带类型的节点描述步骤,Gradio 提供可拖拽画布,每个节点可运行、每个中间结果可见。
推荐理由:原文给出 gr.Workflow 的节点类型、REST 端点和部署路径,读者可据此判断多步 AI 流水线如何落地。
Mistral 发布 Agentic Search,一种面向企业复杂文档的多步检索层,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries 中。
推荐理由:原文给出多步检索循环的工具设计与两组基准数字,读者可据此判断它相对一次性 RAG 的取舍。
Mistral 宣布 Studio 即日起为 Prompts 和 Skills 提供集中管理系统,每个资产可版本化、指定归属并追溯。Studio 将提示词和技能视为生产资产,提供不可变版本、回滚、分类标签和审计日志,并可通过 SDK 接入 GitHub Actions 触发 CI/CD。技能可作为 MCP 服务器直接从 Studio 调用,生产执行的与版本化的资产保持一致。
推荐理由:原文给出提示词与技能版本化、归属和审计的具体机制,读者可据此判断企业如何治理 AI 行为。
Mistral 为 Connectors 推出多项新能力:管理员控制、带 connector 作用域的 API key、多账号 connector 与 Connectors Debugger 均已 GA 或进入 Public Preview。
Hugging Face 发布 Agentic Resource Discovery(ARD)规范的参考实现 Discover Tool,让智能体在运行时按自然语言搜索能力,而不再依赖预先安装。
推荐理由:Hugging Face 给出 ARD 规范的参考实现与 CLI、REST、MCP 三种调用入口,可据此判断智能体能力发现如何从预装目录转向运行时检索。
Hugging Face 重构官方命令行工具 hf CLI,使其同时服务人类用户和 Claude Code、Codex、Cursor 等编码智能体,通过环境变量自动识别智能体并切换输出格式。
Reachy Mini 对话应用现已支持通过 MCP 调用托管在公开 Hugging Face Spaces 上的工具,用户只需执行 `reachy-mini-conversation-app tool-spaces add` 命令即可为机器人添加天气查询、网页搜索等能力,无需改动应用代码。
Mistral 将 Le Chat 升级为统一 AI 智能体 Vibe,一个许可证同时覆盖工作与编码场景,原有对话、设置和套餐全部保留。
推荐理由:Mistral 把 Le Chat 升级为统一智能体 Vibe,读者可据此了解其工作模式与编码模式的能力边界和定价分层。
Hugging Face 发布 AI 智能体术语表,重点厘清 harness、scaffold 与 agent 的区别:model 是 LLM 本身,scaffold 是系统提示词、工具描述与上下文管理等行为定义层,harness 则是调用模型、处理工具调用并决定何时停止的执行层。
Mistral AI 发布企业 AI 编排层 Workflows 公开预览版,提供持久化执行、可观测性和容错能力,ASML、ABANCA、CMA-CGM、France Travail、La Banque Postale、Moeve 等客户已用它自动化关键流程。
推荐理由:原文给出 Workflows 的编排能力、部署模型与已落地客户案例,读者可据此判断企业级 AI 流程如何从概念验证走向生产。
OpenAI 介绍如何在 ChatGPT 中构建和使用工作区智能体(workspace agents),用于自动化重复性工作流、连接工具并简化团队运营。
Mistral AI 发布 Spaces CLI,用于脚手架搭建项目、启动开发环境、生成配置并部署到 staging,典型流程只需 `spaces init`、`cd`、`spaces dev` 三条命令即可获得带热重载、数据库和 Dockerfile 的多服务项目。
Mistral 发布 Leanstral,称其为首个面向 Lean 4 的开源代码智能体,采用 6B 激活参数的稀疏架构,权重以 Apache 2.0 许可开放,并接入 Mistral vibe 的 agent 模式与免费 API 端点 labs-leanstral-2603。
推荐理由:官方给出 Leanstral 的开放权重、免费 API 与 FLTEval 基准,读者可据此判断形式化验证编码智能体的成本与可用性。
Hugging Face 博客介绍 Meta 与 Hugging Face 合作的开源框架 OpenEnv,它用 gym 风格 API(reset、step、action、observations)和标准 MCP 工具调用接口,把智能体接到浏览器、代码仓库、日历等真实系统而非模拟环境中评测。
推荐理由:Meta 与 Hugging Face 的 OpenEnv 框架及 Turing 的 Calendar Gym 给出了智能体在真实权限与多步环境下的失败模式数据。
Mistral 发布终端编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型系列驱动,新增自定义子智能体、多选项澄清、斜杠命令技能和统一智能体模式,CLI 修复持续自动更新。
推荐理由:官方给出 Vibe 2.0 的自定义子智能体、斜杠命令技能与定价变化,可据此判断终端编码智能体的使用成本与工作流。
OpenAI 发起、开源社区共建、Hugging Face 生态支持的 Open Responses 发布,它基于 Responses API 开源扩展,定位为面向智能体的开放推理标准。
推荐理由:原文给出 Open Responses 的规范要点与迁移差异,读者可据此判断现有 Responses API 客户端需要改什么。
OpenAI 宣布开发者可以向 ChatGPT 提交应用,经审核通过后会在产品内新的应用目录中展示,便于用户发现。官方同时更新了工具、指南和 Apps SDK,帮助开发者构建把真实操作带入 ChatGPT 的对话原生体验。
推荐理由:OpenAI 开放 ChatGPT 应用提交与审核入口,开发者可据此判断自家应用进入该生态的路径。
CUGA(Configurable Generalist Agent)是 IBM Research 推出的开源可配置通用智能体,采用 Apache 2.0 许可,现已集成到 Hugging Face Spaces 供试用。