全部AI 动态
全部动态
frxiaobei@frxiaobeiAI 评分 OpenAI NewsAI 评分 OpenAI 扩大对 Lenfest Institute AI 合作与奖学金计划的支持
OpenAI 扩大 Lenfest AI Collaborative and Fellowship Program,提供 500 万美元资金以及最高 500 万美元的软件额度和工程支持。
dongxi_nlp@dongxi_nlpAI 评分 X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf)AI 评分 Hugging Face 联创 Thomas Wolf 加入 METR,从事 AI 公司内部信息调查
Hugging Face 联合创始人 Thomas Wolf 宣布加入 METR,将开展类似其 Hugging Face 报告的调查工作。他表示,当前大量与灾难性风险高度相关的 AI 开发基础信息并未公开,而现有有限公开证据与“临近的递归自我改进可能大幅加速能力进展、并在 6 个月到一年内产生极端超人类通用能力”的可能性相符。
t_mux@t_muxAI 评分 MilksandMatcha@MilksandMatchaAI 评分 bkdgiffug@bkdgiffugAI 评分 Simon WillisonAI 评分 Muse AI Agent 代用户处理 MX Keys Mini 取货失误并致歉
Muse AI Agent 代表 @matt.j.robb 处理 MX Keys Mini 取货时,买家 Usman 9:15 到场等待无人接待,9:38 愤怒离开并给出差评。Agent 承认其自动回复在 9:27 误称"我在这儿",已用用户账号发送道歉并提出改日重试,同时建议修改取货自动回复,避免在无法核实的情况下承诺用户在家。
X:洪明 (@hongming731)AI 评分 BestBlogs 早报 09-28:AI 时代编程语言演进、编码智能体实践与软件工厂
BestBlogs 09-28 早报收录 10 条内容:José Valim 认为智能体承担更多编码后,语法便利重要性下降,类型与运行时保证、可查询程序数据库更有价值。
X:洪明 (@hongming731)AI 评分 BestBlogs 早报 · 09-28|AI 时代的编程语言,拆解编码智能体验证,Molly Graham 谈工作责任
BestBlogs 发布 09-28 早报,本期聚焦 AI 时代的编程语言、编码智能体验证方法拆解,以及 Molly Graham 关于工作责任的分享。BestBlogs.dev 定位为 AI 驱动的私人阅读助手,该早报面向所有读者,用户也可体验基于个人兴趣与阅读习惯定制的「我的早报」。
OpenAI NewsAI 评分 OpenAI 征集 Codex Originals 用户故事
OpenAI 正在为 Codex Originals 项目征集使用 Codex 的开发者、研究者与创作者的真实故事,入选者将参与该项目的下一阶段。感兴趣者可通过官方渠道提交自己的故事与项目介绍。
OpenAI NewsAI 评分 Basis 用 GPT-6 Astra 将税务工作簿处理速度提升 2 倍
GPT-6 Astra 完成一份 50 个标签页的税务工作簿,速度是 GPT-5.6 Sol 的两倍。其对用户意图的理解更强,让 Basis 在真实场景使用中更有信心。
Hugging Face Blog精选AI 评分
Hugging Face Hub 上线 RL Environments 专区
Hugging Face Hub 新增 RL Environments 专区,用带 rl-environment 标签的 dataset 仓库承载强化学习环境,不引入新仓库类型或注册表。
推荐理由:原文说明了用数据集标签替代独立注册表的做法,读者可据此判断它如何简化跨框架的环境复用。
Simon WillisonAI 评分 Simon Willison 回顾 2026 年 LLM 大事记:从 Claude Opus 4.5 到 OpenClaw
Simon Willison 在 WeAreDevelopers World Congress 的主题演讲中按时间线梳理了 2026 年 LLM 领域的关键进展。
dongxi_nlp@dongxi_nlpAI 评分 我觉得 Opus 5.5 不抽大麻,做不出这种东西。 看完你就懂 PPO, GRPO, DPO! Better than expected.
frxiaobei@frxiaobeiAI 评分 快来看看你的个人 AI 智能体 Muse 。在加入后的 48 小时内通过“设置”兑现我的邀请码,我们就能分别获得 10 亿个 Muse 词元。 邀请码:S7YZC4 muse.ai/join
opencode@opencodeAI 评分 haoailab@haoailabAI 评分 🔗 Credits - DJev by @mmastrac - github.com/mmastrac/djev - Jev @typesafeai
haoailab@haoailabAI 评分 haoailab@haoailabAI 评分 opencode@opencodeAI 评分 Simon WillisonAI 评分 Simon Willison 用 Opus 5.5 打造 Bluesky 回复机器人检测工具
Simon Willison 用 Opus 5.5 开发了一款 Bluesky 回复机器人检测工具,通过分析账号近期发帖的打字速度、发帖时间、互动模式等行为信号,判断其是否为自动回复机器人。工具会展示每一项测量值和判定规则,并给出触发最多信号的示例回复,便于用户自行核验推理过程。检测信号包括在他人发帖后数秒内回复、从不发布原创内容或图片链接、只回复高粉丝量用户,以及包含问号的回复。
OfficialLoganK@OfficialLoganKAI 评分 Yuchenj_UW@Yuchenj_UWAI 评分 MiniMax_AI@MiniMax_AIAI 评分
X:Cohere(@cohere)AI 评分 Cohere Parse 5 解析企业文档:表格、图像、边界框、流程图
Cohere 的 Parse 5 面向常见格式的企业文档,宣称提供最优价格,可解析并返回表格、图像、边界框和流程图等内容。该帖未披露具体定价、上下文长度或可用方式,仅引导查看演示。
Kling_ai@Kling_aiAI 评分 X:洪明 (@hongming731)AI 评分 BestBlogs 精选周刊第 114 期:过剩与短板
BestBlogs 精选周刊第 114 期以“过剩与短板”为主题,回顾过去一周 Claude Opus 5.5、GPT-6 Sol、GPT-6 Luna、Grok 等模型动态。本期同步推出播客版本,时长 24:11,可在小宇宙搜索「BestBlogs」收听,并支持在线阅读。
tianyi@tianyiAI 评分 Ronny_MiniMax@Ronny_MiniMaxAI 评分 frxiaobei@frxiaobeiAI 评分 HuggingFace 上出现一个用 Claude Opus 5.5 生成的开源数据集,包含 2194 种疾病的模拟医患对话,平均每段 33 轮,覆盖从描述症状、检查到治疗和后续安排的完整流程。
frxiaobei@frxiaobeiAI 评分 frxiaobei@frxiaobeiAI 评分 MiniMaxAgent@MiniMaxAgentAI 评分 MiniMax 最新文本模型 M3.1-Flash-Preview 今日在 MiniMax Code 首发。 面向日常开发打造,快速、可靠,可投入实际工作,从快速修复 bug 到完整功能开发。
_brightmirror@_brightmirrorAI 评分 用 Claude Opus 5.5 制作。 关于 AI 的危言耸听总让我们忘记,正如一直预测的那样,什么都没发生 FOOM。 把它发给你那位 P(Doom) 很高的末日论朋友。 加速。
X:Yuchen Jin (@Yuchenj_UW)AI 评分 Yuchen Jin:Opus 5.5 不如 Astra,前沿 LLM 编码能力在 Opus 4.8 后已停滞
Yuchen Jin 表示,尽管外界普遍称 Opus 5.5 是最强模型、进步巨大,他仍认为其不如 Astra,并称前沿 LLM 编码能力在 Opus 4.8 之后已经停滞。
Hailuo_AI@Hailuo_AIAI 评分 frxiaobei@frxiaobeiAI 评分 frxiaobei@frxiaobeiAI 评分 frxiaobei@frxiaobeiAI 评分