跳到正文

#Agent

今日 96 条
9月14日周一
  1. X:百度 Baidu (@Baidu_Inc)42

    百度 Miaoda 无代码平台升级:AI 智能体增强,服务超 4000 万用户

    百度 Miaoda 无代码平台完成升级,已服务超 4000 万用户、创建 500 万个商业应用。此次升级增强了设计、应用生成和测试环节的 AI 智能体,并新增私有化部署、协作等企业工具,以及连接企业与创作者的模板和定制开发市场。用户现在只需一条提示词即可开始搭建业务。

9月12日周六
  1. X:Grok (@grok)22

    Warp 原生支持 Grok Build CLI 与 Grok 订阅

    Warp 现已内置支持 Grok Build CLI,可直接在 Warp 中使用 Grok 订阅。用户能用 Warp 的富输入编写智能体提示词,支持更长的粘贴提示词和多光标,并可通过 /remote-control 将智能体会话共享到另一台设备,同时访问文件浏览器和代码审查面板。

9月11日周五
9月10日周四
  1. OpenAI News60

    OpenAI 推出面向金融服务的 ChatGPT

    OpenAI 推出面向金融服务的 ChatGPT,内置金融数据并接入 GPT-6 Astra,用于研究、建模和可直接交付客户的材料。

    推荐理由:原文给出面向金融服务的能力组合与用途,读者可据此判断它在研究与建模场景中的定位。

  2. Hugging Face Blog60

    Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111 图像管线

    Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张包含 11 条媒体管线和 73 个节点的画布,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 与图生视频。

    推荐理由:原文完整拆解了 73 节点画布如何复刻 A1111 的十一类图像管线,可据此迁移到自建多模型工作流。

  3. X:AI at Meta (@AIatMeta)55

    Muse Spark 1.3 在 Website Arena 登顶,Elo 达 1362

    Design Arena 的 Website Arena 榜单显示,Muse Spark 1.3(xhigh)以 Elo 1362 排名第一,较 Muse Spark 1.2 上升 5 位,并在速度与价格上形成新的帕累托前沿。该结果出现在 Muse Spark 1.2 发布仅一个月后,Meta 由此登上 Design Arena 该类别榜首;GPT-6 Astra 的最终结果尚未公布。

9月9日周三
  1. Mistral AI40

    Mistral 如何用 AI 智能体现代化改造复杂遗留代码

    Mistral 帮助一家欧洲能源运营商将 4 万行 Fortran 77 迁移至 C++,对象是一个无测试套件、无集中文档的物理密集型油藏模拟器。团队先构建数值一致性校验框架,再用 Vibe CLI 调度上百个智能体解析调用树并生成文档,最终采用人工介入的 coder、tester、reviewer 智能体工作流逐模块迁移。

9月8日周二
9月7日周一
9月6日周日
9月5日周六
  1. GitHub Blog · AI & ML66

    GitHub 推出 Project HydraFusion 多模型编排研究预览

    GitHub 发布 Project HydraFusion 研究预览,在运行时通过多模型编排完成任务,已面向所有 GitHub Copilot 套餐开放,可在 GitHub Copilot CLI 中通过 /experimental 启用。

    推荐理由:GitHub 官方披露 HydraFusion 的三种编排模式与三套基准的成本质量对比,可据此判断多模型编排在编码任务上的取舍。

9月3日周四
  1. OpenAI News84

    OpenAI 发布 GPT-6 Astra 新一代模型

    OpenAI 发布 GPT-6 Astra,称其为目前最智能、对齐程度最高的模型。官方表示该模型在计算机操作、编码、网络安全和科学领域具备 SOTA 能力。

    推荐理由:OpenAI 官方公布 GPT-6 Astra 的发布信息,读者可据此了解新模型在计算机操作、编码等方向的能力定位。

  2. Google DeepMind60

    Google DeepMind 推出 Fairwind Program,向政府和企业提供 Gemini 3.8 Flash Cyber 网络防御能力

    Google DeepMind 推出 Fairwind Program,面向 Google Cloud 客户、政府机构和网络安全合作伙伴提供受限访问,首批开放其最先进的网络模型 Gemini 3.8 Flash Cyber 与 CodeMender 工具链,用于自主发现、验证并修复漏洞。

    推荐理由:原文给出了面向政府和企业的受限访问计划与配套模型组合,读者可了解其准入范围与责任约束。

  3. Google DeepMind74

    Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber

    Google DeepMind 发布 Gemini 3.8,包含通用模型 Gemini 3.8 Flash 和网络安全模型 Gemini 3.8 Flash Cyber,定价与 3.7 Flash 相同,为每百万输入 token 0.75 美元、每百万输出 token 3.75 美元。

    推荐理由:官方给出 3.8 Flash 与 Cyber 两个变体的基准成绩、定价和开放入口,可据此判断长程编码与漏洞修复的可用性。

9月2日周三
8月31日周一
8月29日周六
  1. X:SpaceXAI (@SpaceXAI)65

    Grok 4.6 上线 Grok.com、iOS 和 Android

    Grok 4.6 现已在 Grok.com、iOS 和 Android 上线。官方建议将其用于复杂问题、智能体式查询以及构建应用等场景。

    推荐理由:Grok 4.6 已在网页与移动端开放,读者可据此了解新版本覆盖的入口和官方给出的三类使用场景。

8月28日周五
8月27日周四
  1. X:美团 LongCat (@Meituan_LongCat)78

    美团 LongCat-2.0 上线 TokenRhythm,1.6T MoE 原生 1M 上下文并开放 MIT 权重

    LongCat-2.0 已在 TokenRhythm 上线,采用 1.6T MoE 架构、约 48B 激活参数、原生 1M 上下文,并以 MIT 许可开放权重。该模型全程在国内 AI ASIC 超算集群上训练,面向仓库级编码和智能体工作流,可通过 OpenSquilla 使用。

    推荐理由:LongCat-2.0 的参数量、激活规模、上下文长度与开源许可集中披露,可据此判断它在代码与智能体场景的定位。

  2. Google DeepMind71

    Google DeepMind 发布语音转文本模型 Gemini 3.5 Transcribe

    Google DeepMind 发布语音转文本模型 Gemini 3.5 Transcribe,可通过 Gemini API 在 Google AI Studio 和 Gemini Enterprise Agent Platform 使用,分为实时流式 gemini-3.5-transcribe-live 和预录音频 gemini-3.5-transcribe 两个接口。

    推荐理由:官方给出流式与非流式两套 API 的 WER 数字和延迟对比,可据此判断语音转写能否接入现有产品。