跳到正文

#Anthropic

今日 45 条
今天10月3日周六
  1. X:Claude (@claudeai)17

    Claude 用浏览器模拟水流等创意作品展示

    Anthropic 展示用户用 Claude 制作的创意项目,包括用 Opus 5.5 构建的可运行水车、可拆解的交互式 3D 喷气发动机,以及用 Sonnet 5.5 制作的纸折弹出式城市。另有用户在 Claude Code 中创作插画诗歌,以及跟随西雅图实时天气与时间的像素漫步项目。

  2. X:Claude (@claudeai)15

    Claude Code 与相机在 Old Street 通宵运行

    Anthropic 展示近期用 Claude 创作的作品合集,其中包括用 Opus 5.5 搭建的可运转水磨、3D 星际飞行网站和可拆解的喷气发动机交互 3D 模型,以及用 Sonnet 5.5 制作的折纸弹出城市。还有一件作品是 Claude Code 配合相机在 Old Street 通宵运行。

  3. X:Thariq (@trq212)62

    Anthropic 为 Claude Code 推出 mods 扩展机制

    Anthropic 的 Thariq 宣布 Claude Code 支持 mods,可改变行为、定制 UI、替换功能,用几行 TypeScript 编写或由 Claude 生成。mods 随插件分发,在 CLI 或桌面应用里用 /plugin 安装,作者举例 next-steps 可给出下一步建议并选择技能与命令,也可派生 forked agents 做额外工作。

  4. X:Rohan Paul (@rohanpaul_ai)78

    研究显示 Claude Opus 5 在会计任务上 20 题全对,12 名注册会计师正确率 0% 至约 90%

    一项针对中等长度、定义明确的会计任务的研究发现,前沿 AI 模型比初级会计师更快更准确,甚至优于研究中表现最好的会计师。Claude Opus 5 在 20 道题中取得 20 题全对、正确率 100%,每题几分钟内完成;12 名持证注册会计师的正确率从 0% 到约 90% 不等,其中数人用完了 3 小时时限。研究还提到,18 个月前这些模型在同类任务上的得分远低于人类会计师。

  5. X:Rohan Paul (@rohanpaul_ai)38

    Blackstone 总裁 Jon Gray:会计、法律、金融等规则型业务将被 AI 彻底颠覆

    Blackstone 总裁兼 COO Jon Gray 此前已提出,会计、法律、金融等规则型业务将被 AI 彻底颠覆,JPMorgan 已用 AI 取代代理顾问处理股东投票。一则对比显示,Claude Opus 5 在 20 项任务中全部以 100% 正确率完成且每项仅需数分钟,而 12 名持证 CPA 的正确率从 0% 到约 90% 不等,多人耗尽 3 小时时限。

  6. X:Rohan Paul (@rohanpaul_ai)42

    Cathie Wood 谈 AI 领域的杰文斯悖论:单次回答成本年降 99.99%,OpenAI 年化收入一年内从 $20B 涨至 $70B

    Cathie Wood 在 ARK Invest 视频中解释 AI 领域的杰文斯悖论:同样的回答每年成本下降 99.99%,但调用量爆炸式增长。即便价格暴跌,OpenAI 的年化收入仍在约一年内从 $20B 升至 $70B,超过 Anthropic 报告的 $65B。她认为更便宜的调用没有压缩业务,反而成为 GDP 爆发式增长的引擎。

  7. X:Karina Nguyen(@karinanguyen)41

    Repovive 数学竞赛 AI 判卷评测:GPT 与 Claude 模型评判数学证明的能力对比

    Repovive 联合 IOI、IMO、ICPC 决赛选手评测 AI 判卷能力,从数学竞赛中选出 534 份可疑或边缘提交,建立统一评分标准与专家参考判断。模型整体偏严,更常拒绝有效提交;清晰指令让 GPT 模型平均提升约 2 个百分点,加入评分示例后 Claude 平均提升约 10 个百分点、GPT 约 5 个百分点。Grok 几乎拒绝一切,仅接受 1–5% 提交,而金标准接受 64.4%。