Ethan Mollick:Dots 属于快速扩张的 Clawlike 类别,团队场景可类比 Slack 中的常驻智能体
Ethan Mollick 称 Dots 属于与 Muse、Grokbot 并列且快速扩张的 Clawlike 类别,用有能力、可访问你数据的模型充当助手和第二意见非常有用。他认为这类工具在团队中有天然对应形态:一个常驻实体,可通过 Slack 等现有团队沟通工具委派任务。他预计很快会出现更多 Clawlike,但不认为它们是这类 AI 的最终形态。
Ethan Mollick 称 Dots 属于与 Muse、Grokbot 并列且快速扩张的 Clawlike 类别,用有能力、可访问你数据的模型充当助手和第二意见非常有用。他认为这类工具在团队中有天然对应形态:一个常驻实体,可通过 Slack 等现有团队沟通工具委派任务。他预计很快会出现更多 Clawlike,但不认为它们是这类 AI 的最终形态。
Amazon Quick 各组件对提示词的解析方式不同,需按组件分别设计。Quick Research 要求明确目标、受众与关注范围,并可从 Quick Index。
Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体,由 Astra 驱动,ChatGPT Pro 和 Enterprise 用户当天可用,并配套推出团队协作的 ChatGPT Space。
推荐理由:现场逐条记录 OpenAI DevDay 2026 的发布节奏,可对照其智能体、模型与开发者平台布局。
Hugging Face 博客介绍论文 ProvenanceGuard,一个面向 MCP 智能体的生成后验证层,专门检测"跨来源混淆"——即事实在证据池中为真、却被归给错误来源。在 281 条医疗智能体真实 trace 上,专家判定 361 条 claim 中 139 条不应通过,ProvenanceGuard 拦下 138 条,并在可识别来源的 claim 上约 86% 选对来源。
Anthropic 的 Thariq Shihipar 在 Latent Space 播客中谈 Claude Code 的下一阶段,包括 Ask User Question、Artifacts、Claude Tag、Projects 和可自定义 harness 的 Claude Mods。
Replit 发布更新,支持为 Meta Quest VR 构建应用、通过 Muse 创建 Replit 应用、接入 Airwallex 支付,并新增 GPT-Sol 6、GPT-6 Luna、Opus 5.5 三款模型。用户还可直接在对话中绘制数据图表并获取洞察,企业版支持在工作流内申请和控制访问权限。
Salesforce AI Research 提出 Critical-State RL,用于多轮工具调用的强化学习:当奖励依赖后续回合时,只训练真正改变结果的那一次调用,而非把奖励摊到整条轨迹上。
用 Claude Opus 5.5 通过 Higgsfield MCP 在 After Effects 中进行动效设计: higgsfield.ai/mcp?tab=claude
Hugging Face 与 NVIDIA 等 100 多家行业伙伴发布 NVIDIA Open Agent Safety Platform,包含开源(Apache 2.0)的 OpenShell 与 Sentry。
H公司发布 Holo4 系列智能体模型,包含 27B dense 与 35B-A3B Mixture of Experts 两个版本,均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 形式开源在 Hugging Face,同时发布 Holotron4 Nano。
推荐理由:Holo4 同时覆盖 GUI、代码、MCP 与 API 四种接口,并公开全部评测轨迹,可据此判断通用计算机操作智能体的路线取舍。
Codex 宕机后,Yuchen Jin 用 Claude Code 定时检查它何时恢复,又用 Jev 决定 Claude Code 何时检查,并自嘲"我可能有点问题"。这条推文引来调侃:两个 AI 协调监控第三个 AI 的宕机,等于搭了一层"中层管理"。
在 X 上可以构建很多很酷的应用,用这个 Grok 机器人轻松上手! 获取灵感请访问 developer.x.com/exhibit
GitHub Copilot 应用中的 canvas(画布扩展)是一种可自定义界面,用户只需在 agent 会话中输入 /create-canvas 并用自然语言描述需求,即可生成看板、发布清单或仪表盘等界面,无需编写代码或手动设计。
探索 Higgsfield 上完整的 Production Skills 技能包: higgsfield.ai/mcp/bundles/pr…
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指定 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做定级并生成漏洞报告。
推荐理由:原文完整披露了 Fuzzing Taskflow 的流水线分层、覆盖反馈循环与崩溃定级机制,可据此判断 LLM 智能体在安全测试中的可迁移边界。
这批新的 MCP 连接今天在 Gemini 应用中推出。 想了解如何将你喜爱的服务直接连接到 Gemini,请访问我们的博客:goo.gle/47ee3Kf
搜索和查询你的工作区、base,并通过 @Airtable 管理你的表格、记录、页面和自动化。 只需让 Gemini 找到“我 Airtable 项目管理 base 中所有未完成的任务”。
Simon Willison 发布 LLM 插件 llm-typesafe 0.1a0,为 TypeSafe AI 的新模型 Jev 提供支持,可通过 `llm install llm-typesafe` 安装并设置 API key 使用。
GitHub Podcast 最新一期逐条拆解了五个 AI 热梗:AI 生成的代码仍需人来负责,只是审查力度应按风险分级;Skills 与 MCP 解决的是不同问题,前者是打包好的经验,后者是连接工具与数据的标准;RAG 并未消亡,它让模型从训练数据之外获取文档、内部知识和代码库上下文,检索不佳会浪费 token、拖慢速度并增加答案不完整的概率。
商汤发布开源智能体办公技能套件 SenseNova Skills,将 Deep Research、数据分析、PPT 生成和信息图生成整合在一起,可直接把原始数据处理成可编辑的 .pptx 文件。
Google Research 在 ACL 2026 提出 ToolGrad,用“先答案后问题”范式生成工具调用数据:先迭代构建可验证的 API 工作流,再反向标注用户查询,数据生成通过率接近 100%。
Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张包含 11 条媒体管线和 73 个节点的画布,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 与图生视频。
推荐理由:原文完整拆解了 73 节点画布如何复刻 A1111 的十一类图像管线,可据此迁移到自建多模型工作流。
OpenAI 发布 Agents API,这是一个由 Codex harness 驱动的托管服务,用于构建和上线云端智能体。该服务支持编排、长时间运行的会话以及工具调用。
推荐理由:官方给出 Agents API 的托管定位与 Codex harness 编排能力,可据此判断云端智能体的搭建方式。