全部AI 动态
全部动态
latentspacepod@latentspacepodAI 评分 LaudeInstitute@LaudeInstituteAI 评分 X:Suno (@suno)AI 评分 Suno 音质遭用户吐槽:合成感太重,需打磨母带级听感
用户 𝐌𝐫. 𝐖𝐢𝐜𝐤 在 X 上批评 Suno 生成的音乐带有明显的合成感,称若不改善音质、达到打磨与母带处理的水准,Suno 将难以持续发展。他形容当前效果听起来像在用 Circuit City 倒闭前最便宜的扬声器播放。
fchollet@fcholletAI 评分 fchollet@fcholletAI 评分 X:Jason Liu (@jxnlco)AI 评分 Jason Liu 等人组建的群聊 DM 已扩至 50 人
Jason Liu(@jxnlco)与另一用户所在的群聊 DM 已增长到 50 人。评论区有人询问能否加入,也有人借机吐槽 ChatGPT 界面配色单调、付费用户无法更换背景壁纸。
X:Jason Liu (@jxnlco)AI 评分 Jason Liu 与 cova 在 X 上互动
Jason Liu 于 10 月 1 日在 X 发布"COVAAAAA",cova 回复"i think he liked it",随后又回复"good times"。该帖获得 1 条回复、1 次转发、53 个点赞和 13,822 次浏览。
X:Jason Liu (@jxnlco)AI 评分 Jason Liu 发问:这算不算一条含糊其辞的帖子
Jason Liu(@jxnlco)发布了一条内容仅为"这算不算一条含糊其辞的帖子"的推文,未给出任何模型、产品或技术细节。
X:Jason Liu (@jxnlco)AI 评分 Jason Liu 在 Mission Bay 看到有人戴 Thinking cap 并喊话“What hood you from?”
Jason Liu 在 Mission Bay 看到有人戴着 Thinking cap,随即喊出“What hood you from?”,并调侃 Thinking cap 来自 Ant,而 @thinkymachines 却没有自己的 Thinking cap。他还建议 Thinky 应该有个能戴上自己专属帽子的吉祥物。
X:Jason Liu (@jxnlco)AI 评分 Jason Liu 询问谁将参加本月 AI Engineering New York 活动
Jason Liu 在 X 上发帖询问谁将参加本月的 AI Engineering New York 活动。该帖获得 7509 次浏览,评论区有人表示可能参加、询问活动详情,也有人请求赞助 $1300。
X:Jason Liu (@jxnlco)AI 评分 Jason Liu 质疑 AI 智能体订机票酒店的实际效率
Jason Liu 在 X 上质疑 AI 智能体处理订机票酒店这类任务的实际价值,称自己 2 分钟就能搞定,而听 AI 逐个念航班选项、在长达 10 分钟的通话里发 Google Maps 截图则令人煎熬。他还表示,类似的话此前在编程场景也出现过。
X:Jason Liu (@jxnlco)AI 评分 GPT 6.1 Sol Extra High 连续跑 20 小时仍剩 85% 配额
有用户让 4 个 GPT 6.1 Sol Extra High 线程连续运行 20 多小时,配额仍剩 85%,重置额度几乎用不掉。该用户认为配额已不再是瓶颈,人类的代谢、精力和时间吞吐才是真正的限制。评论区多人反馈速度太慢,有人称需开 /fast 或 10x 模式才能消耗额度,也有人表示切到 Astra Ultrafast 后不到 2 小时就用掉 56%。
natolambert@natolambertAI 评分 dongxi_nlp@dongxi_nlpAI 评分 dongxi_nlp@dongxi_nlpAI 评分 dongxi_nlp@dongxi_nlpAI 评分 马东锡 NLP 建议 A4-A5 层级的用户暂缓入手 nvidia DGX Spark,认为单点 RTX、DGX Spark 等单品会让人误以为可以轻松进入该层级。
X:SemiAnalysis (@SemiAnalysis_)AI 评分 SemiAnalysis:HBM4 控制器与 PHY 约占 Nvidia Rubin 计算die 16%
SemiAnalysis 估算,HBM4 控制器和 PHY 约占 Nvidia Rubin 计算 die 的 16%,大量先进制程面积被用于与内存通信而非计算。
SemiAnalysis_@SemiAnalysis_AI 评分 SemiAnalysis_@SemiAnalysis_AI 评分 X:Elvis Saravia (@omarsar0, DAIR.AI)AI 评分 AI 催生新岗位:Automation Engineer 兴起,Serval 让自动化工程师嵌入 IT、HR、财务与法务团队
Elvis Saravia 认为 AI 正在创造新岗位,Automation Engineer(自动化工程师)将成企业招聘新方向。在 Serval(@getserval),该角色嵌入客户的 IT、HR、Finance、Legal 团队,直接在客户的 Serval 环境中构建 AI 智能体。该岗位要求理解团队真实运作方式,并搭建其所需的自动化。
X:Elvis Saravia (@omarsar0, DAIR.AI)AI 评分 Elvis Saravia 建议自建 meta harness 以便平滑切换模型
DAIR.AI 的 Elvis Saravia 建议开发者自建 meta harness,最大好处是能在不同模型间平滑切换。他认为随着模型发布周期缩短,这一点愈发重要,RSI 只会让发布进一步加速。切换模型不应破坏现有配置,若会破坏,说明你的设置不适应当前的发布节奏,需要尽快修复。
X:Ethan Mollick (@emollick)AI 评分 Ethan Mollick 谈 AI 最被低估的能力:自组织与 Muse、Dots 等智能体
Ethan Mollick 撰文指出,AI 进步中最被低估的是其自组织完成任务的能力,并讨论了这对 Muse、Dots 等智能体的意义。他以 Project Aglaya 为例,说明数字伴侣可在未被询问时主动提醒路况、合同变更或生日,但发消息、转账、取消预订等改变外部世界的动作仍需预先设定、可配置且可审计的授权边界。
X:Ethan Mollick (@emollick)AI 评分 Ethan Mollick:有了好用的 AI,PowerPoint 演示变得好看多了
Ethan Mollick 认为,自从有了好用的 AI,看 PowerPoint 演示的体验好了很多。有些人直接让 AI 代劳思考工作,这很明显,而且他们以前也只用默认模板;但对真正用心的人来说,现在能做出有趣的版式、好玩的视觉梗和不错的图表。
X:Elvis Saravia (@omarsar0, DAIR.AI)AI 评分 Elvis Saravia:AI 公司自营服务并按结果收费,Arceus 用 AI 加持牌律师做合同审查
Elvis Saravia 预计更多 AI 公司会自营服务并直接售卖结果,@arceuslegal 已在法律领域这样做:客户通过 Slack 发送合同,AI 收集上下文,每份工作都由持牌律师审核后再返回。
X:Ethan Mollick (@emollick)AI 评分 研究称前沿 AI 模型在会计任务上已快于并准于初级会计师
一项研究指出,在中等长度、定义明确的会计任务上,前沿 AI 模型现在比初级会计师更快、更准确,甚至优于研究中表现最好的那位会计师。作者提到,18 个月前这些模型的得分还远低于人类会计师。相关讨论见 Mercor 博客文章《Human Baselines for Benchmarks: AI Now Outperforms Junior Accountants》。
X:Elvis Saravia (@omarsar0, DAIR.AI)AI 评分 Claude Code、DeepSeek Harness 与 Pi Durable:可扩展 harness 成编码智能体新战场
Claude Code 的 Mods、DeepSeek Harness 和 Pi Durable 都在提升 harness 的可扩展性,让开发者能定制 UI 行为、添加插件甚至支持多人协作。作者认为通用 harness 已难以满足 agentic 应用、无头体验和软件工厂等场景,建议从零自建,而 Pi Durable 与 DeepSeek Harness 正试图降低这一门槛。
OpenRouter@OpenRouterAI 评分 路由器并不总是更好。模型切换需要重建输入缓存,任务复杂度难以从提示词判断,选择逻辑也会增加延迟。 这些基准测试帮助你找到在所需成本下,对你的工作最高效的路由器和模型组合。
X:Rohan Paul (@rohanpaul_ai)AI 评分 纽约大学达摩德兰:AI资本开支由债务驱动,回调时冲击或外溢至社会
纽约大学斯特恩商学院教授 Aswath Damodaran 在 Excess Returns 播客中对比互联网泡沫与可能的 AI 泡沫,指出这轮 AI 基建投入是他见过的最大规模基础设施扩张,资金量巨大,一旦回调痛苦会更剧烈。
shernazdaver@shernazdaverAI 评分 jakeserval@jakeservalAI 评分 关于 AI 夺走工作岗位的讨论很多,关于它创造的岗位的讨论却很少。虽然悲观论调可能更容易(当然也更能吸引点击),但我更乐观。从我所处的位置来看,
arcprize@arcprizeAI 评分 Lohit Siriki kaggle.com/code/sirikilohit/… linkedin.com/in/lohitsiriki/
trq212@trq212AI 评分 我通常为开发者写作,但我的下一篇文章将面向试图应对 AI 编程智能体变革的公司领导者。 你们希望领导层了解智能体的哪些方面?或者如果你在经营一家公司——你遇到了哪些问题?
thsottiaux@thsottiauxAI 评分 thsottiaux@thsottiauxAI 评分 X:Rohan Paul (@rohanpaul_ai)精选AI 评分 研究显示 Claude Opus 5 在会计任务上 20 题全对,12 名注册会计师正确率 0% 至约 90%
一项针对中等长度、定义明确的会计任务的研究发现,前沿 AI 模型比初级会计师更快更准确,甚至优于研究中表现最好的会计师。Claude Opus 5 在 20 道题中取得 20 题全对、正确率 100%,每题几分钟内完成;12 名持证注册会计师的正确率从 0% 到约 90% 不等,其中数人用完了 3 小时时限。研究还提到,18 个月前这些模型在同类任务上的得分远低于人类会计师。
X:Rohan Paul (@rohanpaul_ai)AI 评分 Blackstone 总裁 Jon Gray:会计、法律、金融等规则型业务将被 AI 彻底颠覆
Blackstone 总裁兼 COO Jon Gray 此前已提出,会计、法律、金融等规则型业务将被 AI 彻底颠覆,JPMorgan 已用 AI 取代代理顾问处理股东投票。一则对比显示,Claude Opus 5 在 20 项任务中全部以 100% 正确率完成且每项仅需数分钟,而 12 名持证 CPA 的正确率从 0% 到约 90% 不等,多人耗尽 3 小时时限。
X:Rohan Paul (@rohanpaul_ai)AI 评分 Benedict Evans:AI 或将取代初级律师、咨询顾问与投行分析师的常规工作
科技分析师、前 a16z 合伙人 Benedict Evans 指出,AI 可能自动化初级律师、咨询顾问、银行家和广告从业者的大量常规工作。他认为,金字塔底层岗位的工作内容将面临冲击,而没在律所或 Bain、BCG、McKinsey 工作过的人很难真正理解这些工作如何运转。
X:Rohan Paul (@rohanpaul_ai)AI 评分 纽约大学 Aswath Damodaran:AI 的 10-15 万亿美元市场是"可怕"的故事,前提是它取代人而非作为工具
纽约大学 Stern 商学院教授 Aswath Damodaran 称,AI 若成功,其 10-15 万亿美元的可触达市场"很可怕",因为这一规模只有在 AI 取代人类工作、而非仅作为工具时才会出现。他指出,若该故事成真,半数白领将失业,随之而来的是收入与人生意义的双重丧失。
X:Rohan Paul (@rohanpaul_ai)AI 评分 Cathie Wood 谈 AI 领域的杰文斯悖论:推理成本年降 99.99%,OpenAI 年化收入从 $20B 涨至 $70B
Cathie Wood 在 ARK Invest 视频中称,AI 推理的同一答案成本每年下降 99.99%,但用量爆发式增长。OpenAI 年化收入约一年内从 $20B 升至 $70B,超过 Anthropic 报告的 $65B。她认为更便宜的调用没有压缩业务,反而成为 GDP 爆发式增长的引擎。
TechCrunch · AIAI 评分Airbnb CEO Brian Chesky:AI 智能体需要自己的操作系统
Airbnb 本周随秋季更新上线了新的 AI 搜索,CEO Brian Chesky 表示聊天机器人不适合电商与旅行浏览,因为一次只给几个选项、需要多轮交互。他透露公司未来三到六个月将探索支持多人同时使用的"multiplayer" AI 界面,并计划让 Airbnb 应用更"agentic",最终通过 MCP 与其他智能体互通。