跳到正文
10月3日 · 周六

最新精选

今天10月3日周六
  1. X:fal (@fal)71

    Black Forest Labs 的 FLUX 3 Image 在 fal 上线

    Black Forest Labs 的 FLUX 3 Image 已在 fal 平台上线,主打精准图像编辑,保留未修改部分。该模型支持原生 2K 和 4K 图像生成,最多可组合 10 张参考图,能在一次生成中完成多处定向编辑,并对布局和构图提供细致控制。

    推荐理由:FLUX 3 Image 在 fal 上线,列出原生 2K/4K 生成与多参考图编辑等能力,可据此判断图像编辑工作流的变化。

10月2日周五
  1. NVIDIA Blog62

    NVIDIA DGX Spark 推出 64GB 版本,10 月 23 日开售 4999 美元起

    NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 推出 64GB 统一内存版 DGX Spark,10 月 23 日开售,起售价 4999 美元,保留 GB10 Grace Blackwell 超级芯片、DGX OS 与完整 NVIDIA AI 软件栈,支持最高 1000 亿参数模型在设备本地运行。

    推荐理由:原文给出 64GB 新配置的价格、可跑模型规模与双机集群方式,便于判断本地跑智能体的硬件门槛。

  2. NVIDIA Blog62

    NVIDIA GPU 加速 OpenAI GPT-6 Astra Ultrafast 上线

    OpenAI 的 GPT-6 Astra Ultrafast 已在 NVIDIA Blackwell GPU 上运行,并面向 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户开放。

    推荐理由:OpenAI 在 NVIDIA Blackwell 上推出 Astra Ultrafast 模式,读者可了解其相对标准模式的提速幅度与开放入口。

10月1日周四
  1. X:fal (@fal)66

    Ideogram 4.5 上线 fal,主打精准图像编辑

    Ideogram 4.5 已在 fal 上线,定位为精准编辑图像模型。官方称连续进行十次编辑后,94–99% 未被要求改动的部分保持不变。该模型支持按原文渲染任意语言的文字排版,可用 mask 编辑或最多 4 张参考图引导修改,并在同一 endpoint 内完成文生图与编辑。

    推荐理由:原文给出连续编辑的保持率区间和参考图数量,读者可据此判断图像编辑在多次修改后的稳定性。

9月30日周三
  1. Latent Space88

    OpenAI DevDay 2026 发布 Dots、GPT-6.1 Sol、Ultrafast 与 Decisions API

    OpenAI 在 DevDay 2026 上发布 Dots 常驻智能体、GPT-6.1 Sol、Ultrafast 模式、Decisions API、ChatGPT Spaces 与 Marketplace,并称 ChatGPT 周活达 12 亿。

    推荐理由:汇总了 OpenAI DevDay 2026 的发布清单与第三方评测数据,可快速了解各家模型在成本与能力上的相对位置。

  2. X:OpenAI (@OpenAI)78

    OpenAI 推出 Ultrafast 速度档与 Pro 500 订阅,GPT-6 Astra 已可用

    OpenAI 推出 Ultrafast 速度档,在 Codex 中 token 生成最高快 8 倍(300 tokens per second),在 API 中最高快 6 倍。

    推荐理由:OpenAI 公布 Ultrafast 速度档与 Pro 500 订阅的具体倍率和 token 速度,读者可据此判断日常编码与 API 调用的成本变化。

  3. X:OpenAI (@OpenAI)82

    OpenAI 推出 Ultrafast 速度档与 Pro 500 订阅,并重启 Pro 200

    OpenAI 推出 Ultrafast 高级速度档,在 Codex 中 token 生成最高提速 8 倍(300 tokens per second),在 API 中最高提速 6 倍。

    推荐理由:OpenAI 公布 Ultrafast 速度档与 Pro 500 新订阅档,读者可据此比较各档位的速度与用量差异。

  4. X:OpenAI (@OpenAI)69

    OpenAI 升级 Codex Security Cloud,默认接入 Daybreak Blue 模型

    OpenAI 宣布 Codex Security Cloud 迎来重大升级,默认通过 Daybreak Blue 获得具备网络安全能力的模型。该功能可扫描整个 GitHub 仓库、持续审查新提交、调查并去重发现的问题,并准备好待审阅的修复方案,即使笔记本关闭也能运行。它已作为插件在 Codex 桌面端和网页端提供。

    推荐理由:Codex Security Cloud 升级后默认接入 Daybreak Blue 模型,可扫描整个 GitHub 仓库并持续审查新提交,读者可据此判断代码安全流程的变化。

  5. X:OpenAI (@OpenAI)87

    OpenAI 推出由 GPT-6 Astra 驱动的 dots 常驻智能体

    OpenAI 发布 dots,由 GPT-6 Astra 驱动,是常驻后台、可自主推进任务的智能体,拥有自己的云端计算机,可通过 ChatGPT 连接 4000+ 应用。

    推荐理由:OpenAI 官方给出 dots 的能力边界、接入范围与安全控制方式,可据此判断常驻智能体的落地形态。

9月29日周二
  1. Simon Willison85

    OpenAI DevDay 2026 现场实录:发布 Dots 智能体、GPT-6.1 Sol 与 Ultrafast

    Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体,由 Astra 驱动,ChatGPT Pro 和 Enterprise 用户当天可用,并配套推出团队协作的 ChatGPT Space。

    推荐理由:现场逐条记录 OpenAI DevDay 2026 的发布节奏,可对照其智能体、模型与开发者平台布局。

9月25日周五
  1. GitHub Blog · AI & ML62

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体,自动为 C/C++ 项目做模糊测试

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指定 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做定级并生成漏洞报告。

    推荐理由:原文完整披露了 Fuzzing Taskflow 的流水线分层、覆盖反馈循环与崩溃定级机制,可据此判断 LLM 智能体在安全测试中的可迁移边界。

  2. Google DeepMind70

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,把近实时视频生成与语音对话结合,为原生实时对话模型加入动态视觉形象,即日起在 Gemini Enterprise 可用。

    推荐理由:官方给出 Live Avatar 的能力边界与开放入口,读者可据此判断实时视频对话在企业场景的可用性。

9月23日周三
  1. X:通义千问 / Qwen (@Alibaba_Qwen)78

    通义千问发布 Qwen Intelligence,推出三个移动端 SOTA 智能体

    通义千问发布 Qwen Intelligence,首批包含三个 SOTA 智能体。Mobile Planner Agent 负责任务规划、拆解与编排,在 MobilePA-Bench。

    推荐理由:官方给出三个移动端智能体的分工、基准成绩与开源评测套件入口,可据此判断手机端 Agent 的能力边界。

9月18日周五
  1. X:MiniMax (@MiniMax_AI)66

    MiniMax Code CLI v0.4.12 开源,MIT 协议发布并在 FrontierHarness Eval 取得 SOTA

    MiniMax 将 MiniMax Code CLI v0.4.12 面向全球开发者开放,并以 MIT 协议开源。官方称该工具在 FrontierHarness Eval 上取得了 state-of-the-art 的通过率。

    推荐理由:MiniMax 把 Code CLI 以 MIT 协议开源并给出 FrontierHarness Eval 成绩,读者可据此判断其编码工具链的开放程度。

8月20日周四
  1. Mistral AI66

    Mistral 发布 Agentic Search,FinanceBench 正确率从 26.7% 升至 86%

    Mistral 发布 Agentic Search,一种面向企业复杂文档的多步检索层,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries 中。

    推荐理由:原文给出多步检索循环的工具设计与两组基准数字,读者可据此判断它相对一次性 RAG 的取舍。

8月11日周二
  1. Mistral AI60

    Mistral 推出区域推理端点与 Priority Tier,并支持第三方开源模型 GLM-5.2

    Mistral 宣布三项推进 AI 主权的举措:Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行;Mistral Priority Tier 进入公开预览,为关键业务负载提供承诺服务等级、自定义速率限制和 uptime SLA。

    推荐理由:Mistral 把区域推理端点、优先级服务层与第三方开源模型接入放在同一套基础设施上,读者可据此判断主权 AI 的落地路径。

已经到底了