全部AI 动态
全部动态
SemiAnalysis_@SemiAnalysis_AI 评分 SemiAnalysis_@SemiAnalysis_AI 评分 X:Elvis Saravia (@omarsar0, DAIR.AI)AI 评分 AI 催生新岗位:Automation Engineer 兴起,Serval 让自动化工程师嵌入 IT、HR、财务与法务团队
Elvis Saravia 认为 AI 正在创造新岗位,Automation Engineer(自动化工程师)将成企业招聘新方向。在 Serval(@getserval),该角色嵌入客户的 IT、HR、Finance、Legal 团队,直接在客户的 Serval 环境中构建 AI 智能体。该岗位要求理解团队真实运作方式,并搭建其所需的自动化。
X:Elvis Saravia (@omarsar0, DAIR.AI)AI 评分 Elvis Saravia 建议自建 meta harness 以便平滑切换模型
DAIR.AI 的 Elvis Saravia 建议开发者自建 meta harness,最大好处是能在不同模型间平滑切换。他认为随着模型发布周期缩短,这一点愈发重要,RSI 只会让发布进一步加速。切换模型不应破坏现有配置,若会破坏,说明你的设置不适应当前的发布节奏,需要尽快修复。
X:Ethan Mollick (@emollick)AI 评分 Ethan Mollick 谈 AI 最被低估的能力:自组织与 Muse、Dots 等智能体
Ethan Mollick 撰文指出,AI 进步中最被低估的是其自组织完成任务的能力,并讨论了这对 Muse、Dots 等智能体的意义。他以 Project Aglaya 为例,说明数字伴侣可在未被询问时主动提醒路况、合同变更或生日,但发消息、转账、取消预订等改变外部世界的动作仍需预先设定、可配置且可审计的授权边界。
X:Ethan Mollick (@emollick)AI 评分 Ethan Mollick:有了好用的 AI,PowerPoint 演示变得好看多了
Ethan Mollick 认为,自从有了好用的 AI,看 PowerPoint 演示的体验好了很多。有些人直接让 AI 代劳思考工作,这很明显,而且他们以前也只用默认模板;但对真正用心的人来说,现在能做出有趣的版式、好玩的视觉梗和不错的图表。
X:Elvis Saravia (@omarsar0, DAIR.AI)AI 评分 Elvis Saravia:AI 公司自营服务并按结果收费,Arceus 用 AI 加持牌律师做合同审查
Elvis Saravia 预计更多 AI 公司会自营服务并直接售卖结果,@arceuslegal 已在法律领域这样做:客户通过 Slack 发送合同,AI 收集上下文,每份工作都由持牌律师审核后再返回。
X:Ethan Mollick (@emollick)AI 评分 研究称前沿 AI 模型在会计任务上已快于并准于初级会计师
一项研究指出,在中等长度、定义明确的会计任务上,前沿 AI 模型现在比初级会计师更快、更准确,甚至优于研究中表现最好的那位会计师。作者提到,18 个月前这些模型的得分还远低于人类会计师。相关讨论见 Mercor 博客文章《Human Baselines for Benchmarks: AI Now Outperforms Junior Accountants》。
X:Elvis Saravia (@omarsar0, DAIR.AI)AI 评分 Claude Code、DeepSeek Harness 与 Pi Durable:可扩展 harness 成编码智能体新战场
Claude Code 的 Mods、DeepSeek Harness 和 Pi Durable 都在提升 harness 的可扩展性,让开发者能定制 UI 行为、添加插件甚至支持多人协作。作者认为通用 harness 已难以满足 agentic 应用、无头体验和软件工厂等场景,建议从零自建,而 Pi Durable 与 DeepSeek Harness 正试图降低这一门槛。
OpenRouter@OpenRouterAI 评分 路由器并不总是更好。模型切换需要重建输入缓存,任务复杂度难以从提示词判断,选择逻辑也会增加延迟。 这些基准测试帮助你找到在所需成本下,对你的工作最高效的路由器和模型组合。
X:Rohan Paul (@rohanpaul_ai)AI 评分 纽约大学达摩德兰:AI资本开支由债务驱动,回调时冲击或外溢至社会
纽约大学斯特恩商学院教授 Aswath Damodaran 在 Excess Returns 播客中对比互联网泡沫与可能的 AI 泡沫,指出这轮 AI 基建投入是他见过的最大规模基础设施扩张,资金量巨大,一旦回调痛苦会更剧烈。
shernazdaver@shernazdaverAI 评分 jakeserval@jakeservalAI 评分 关于 AI 夺走工作岗位的讨论很多,关于它创造的岗位的讨论却很少。虽然悲观论调可能更容易(当然也更能吸引点击),但我更乐观。从我所处的位置来看,
arcprize@arcprizeAI 评分 Lohit Siriki kaggle.com/code/sirikilohit/… linkedin.com/in/lohitsiriki/
trq212@trq212AI 评分 我通常为开发者写作,但我的下一篇文章将面向试图应对 AI 编程智能体变革的公司领导者。 你们希望领导层了解智能体的哪些方面?或者如果你在经营一家公司——你遇到了哪些问题?
thsottiaux@thsottiauxAI 评分 thsottiaux@thsottiauxAI 评分 X:Rohan Paul (@rohanpaul_ai)精选AI 评分 研究显示 Claude Opus 5 在会计任务上 20 题全对,12 名注册会计师正确率 0% 至约 90%
一项针对中等长度、定义明确的会计任务的研究发现,前沿 AI 模型比初级会计师更快更准确,甚至优于研究中表现最好的会计师。Claude Opus 5 在 20 道题中取得 20 题全对、正确率 100%,每题几分钟内完成;12 名持证注册会计师的正确率从 0% 到约 90% 不等,其中数人用完了 3 小时时限。研究还提到,18 个月前这些模型在同类任务上的得分远低于人类会计师。
X:Rohan Paul (@rohanpaul_ai)AI 评分 Blackstone 总裁 Jon Gray:会计、法律、金融等规则型业务将被 AI 彻底颠覆
Blackstone 总裁兼 COO Jon Gray 此前已提出,会计、法律、金融等规则型业务将被 AI 彻底颠覆,JPMorgan 已用 AI 取代代理顾问处理股东投票。一则对比显示,Claude Opus 5 在 20 项任务中全部以 100% 正确率完成且每项仅需数分钟,而 12 名持证 CPA 的正确率从 0% 到约 90% 不等,多人耗尽 3 小时时限。
X:Rohan Paul (@rohanpaul_ai)AI 评分 Benedict Evans:AI 或将取代初级律师、咨询顾问与投行分析师的常规工作
科技分析师、前 a16z 合伙人 Benedict Evans 指出,AI 可能自动化初级律师、咨询顾问、银行家和广告从业者的大量常规工作。他认为,金字塔底层岗位的工作内容将面临冲击,而没在律所或 Bain、BCG、McKinsey 工作过的人很难真正理解这些工作如何运转。
X:Rohan Paul (@rohanpaul_ai)AI 评分 纽约大学 Aswath Damodaran:AI 的 10-15 万亿美元市场是"可怕"的故事,前提是它取代人而非作为工具
纽约大学 Stern 商学院教授 Aswath Damodaran 称,AI 若成功,其 10-15 万亿美元的可触达市场"很可怕",因为这一规模只有在 AI 取代人类工作、而非仅作为工具时才会出现。他指出,若该故事成真,半数白领将失业,随之而来的是收入与人生意义的双重丧失。
X:Rohan Paul (@rohanpaul_ai)AI 评分 Cathie Wood 谈 AI 领域的杰文斯悖论:推理成本年降 99.99%,OpenAI 年化收入从 $20B 涨至 $70B
Cathie Wood 在 ARK Invest 视频中称,AI 推理的同一答案成本每年下降 99.99%,但用量爆发式增长。OpenAI 年化收入约一年内从 $20B 升至 $70B,超过 Anthropic 报告的 $65B。她认为更便宜的调用没有压缩业务,反而成为 GDP 爆发式增长的引擎。
TechCrunch · AIAI 评分Airbnb CEO Brian Chesky:AI 智能体需要自己的操作系统
Airbnb 本周随秋季更新上线了新的 AI 搜索,CEO Brian Chesky 表示聊天机器人不适合电商与旅行浏览,因为一次只给几个选项、需要多轮交互。他透露公司未来三到六个月将探索支持多人同时使用的"multiplayer" AI 界面,并计划让 Airbnb 应用更"agentic",最终通过 MCP 与其他智能体互通。
TechCrunch · AIAI 评分教皇利奥十四世公开批评 AI 生成艺术
教皇利奥十四世在 X 发帖称,AI 时代亟需区分人类艺术与机器产物,二者存在本体论差异,算法缺乏人性的火花。他曾在 5 月的通谕中详述 AI 与人类尊严问题。据《纽约时报》报道,Anthropic 曾游说梵蒂冈重新考虑其在非人类意识上的立场,但收效甚微。
cohere@cohereAI 评分 runwayml@runwaymlAI 评分 fal@falAI 评分 aileenvl@aileenvlAI 评分 本周,我作为少数获得行程资助的大使之一,首次在旧金山参加了 @OpenAI DevDay,资助涵盖机票、酒店、交通和 DevDay 门票。 当我
mrmagan_@mrmagan_AI 评分 simpsoka@simpsokaAI 评分 Awesome Sites 开放投票了。去给你最喜欢的投一票吧!我个人觉得 Jelly Hockey 需要一些关注。#awesomesites
thsottiaux@thsottiauxAI 评分 X:Rohan Paul (@rohanpaul_ai)AI 评分 Eric Schmidt 解释为何 AI 竞赛无法实现相互暂停
Eric Schmidt 认为 AI 竞赛的相互暂停不可能实现:美国缺乏停止动力,本地实验室或中国可能作弊,而联合国核查无法读懂由计算机编写的代码。他指出核查需要检查人员进入包括军事实验室在内的秘密实验室并审查全部代码库,但这些代码由计算机编写,没有人类团队能逐行阅读。
X:Rohan Paul (@rohanpaul_ai)AI 评分 Eric Schmidt 解释为何 AI 竞赛无法实现相互暂停
Eric Schmidt 认为 AI 竞赛无法相互暂停,因为美国缺乏停止动力,本地实验室或中国可能作弊,而联合国核查既无法读懂由计算机编写的代码,也追不上美中实验室的进度。他指出这种暂停无法被验证:核查人员需进入包括军事实验室在内的秘密实验室审查全部代码库,而这些代码由计算机编写,没有人类团队能逐行读完。相关观点来自《The Economist》YouTube 频道。
Yuchenj_UW@Yuchenj_UWAI 评分 SemiAnalysis_@SemiAnalysis_AI 评分 X:Jason Liu (@jxnlco)AI 评分 Jason Liu 回应「AI 演示不真实」质疑:问题在用户不在智能体
Jason Liu 反驳「这些演示不真实」的说法,称质疑者是把醒着的时间都花在了 Twitter 上。他指出真正不真实的是演示用户而非智能体:演示用户清楚该问什么,而真实学习者只会高亮一句话然后输入「huh??」。
sama@samaAI 评分 挂掉一天中最后一个充满高压决策的电话,一分钟后走进家门,迎接我的是小孩子们纯粹的爱——他们想笑、想玩,想把当天的每一个发现都展示给你看。这种反差是我人生中经历过最奇妙也最美好的事。
hongming731@hongming731AI 评分 hongming731@hongming731AI 评分 在线阅读本期早报 BestBlogs.dev 是 AI 驱动的私人阅读助手。这是面向所有人的每日早报内容,如果你希望它基于你的兴趣和阅读习惯整理,可以体验「我的早报」。 导语
emollick@emollickAI 评分 目前最好的证据支持一个有限的结论:AI 可能已经在影响最易受 AI 冲击的初级白领岗位的招聘边缘,但这一归因存在争议,且整体劳动力市场的扰动尚未在数据中显现。