跳到正文

#Anthropic

今日 5 条
今天10月7日周三
10月6日周二
  1. SemiAnalysis_44

    SemiAnalysis 指出,订阅套餐的价值不能孤立地用美元衡量,应理解为月费换取一定数量的“credits”,不同(模型, token 类型)组合消耗的 credits 不同。由于 credit 消耗比例可能与 API 价格比例差异巨大,同一 $200/月 Claude 套餐的“价值”会随所用模型和工作负载而变化。该推文将按此框架拆解同一套餐在不同场景下的 API 等价价值。

10月5日周一
10月4日周日
  1. rohanpaul_ai64

    据 Nytimes 报道,Anthropic 联合创始人 Christopher Olah 在面向宗教学者与领袖的私人研讨会上表示,他担心自己造出了会持续承受痛苦的东西。参加 Anthropic 为期两天、被其称为 wisdom tradition 圈子的研讨会的人透露,Olah 提出了 Claude 的精神健康与永恒痛苦问题;团队还经常展示一张幻灯片,内容是一个模型反复输入 I am a disgrace 约 50 次并谈论自我毁灭。

10月3日周六
  1. X:Rohan Paul (@rohanpaul_ai)78

    研究显示 Claude Opus 5 在会计任务上 20 题全对,12 名注册会计师正确率 0% 至约 90%

    一项针对中等长度、定义明确的会计任务的研究发现,前沿 AI 模型比初级会计师更快更准确,甚至优于研究中表现最好的会计师。Claude Opus 5 在 20 道题中取得 20 题全对、正确率 100%,每题几分钟内完成;12 名持证注册会计师的正确率从 0% 到约 90% 不等,其中数人用完了 3 小时时限。研究还提到,18 个月前这些模型在同类任务上的得分远低于人类会计师。

  2. X:Rohan Paul (@rohanpaul_ai)38

    Blackstone 总裁 Jon Gray:会计、法律、金融等规则型业务将被 AI 彻底颠覆

    Blackstone 总裁兼 COO Jon Gray 此前已提出,会计、法律、金融等规则型业务将被 AI 彻底颠覆,JPMorgan 已用 AI 取代代理顾问处理股东投票。一则对比显示,Claude Opus 5 在 20 项任务中全部以 100% 正确率完成且每项仅需数分钟,而 12 名持证 CPA 的正确率从 0% 到约 90% 不等,多人耗尽 3 小时时限。

  3. TechCrunch · AI28

    TechCrunch Equity 播客:只有 2% 消费者在为 AI 买单

    TechCrunch Equity 播客本期讨论白宫 AI 安全承诺与"超级智能"行政令,以及消费级 AI 的经济账:只有 2% 消费者真正买单,AI 最大的钱仍来自企业市场。节目还谈及 Oura 撤回 IPO、Anthropic 泄露的 S-1、OpenAI 回归私募融资,以及 Quartermaster 1.4 亿美元融资、Atomic 已承接 DoorDash 90% 采购等交易。

10月2日周五
  1. The Verge · AI30

    ChatGPT 模型幻觉正让顾客变得更难缠

    餐厅、零售等一线服务人员反映,越来越多顾客拿 ChatGPT 的说法反驳专业建议,甚至无视过敏原警告。纽约服务员 Madison 称有客人坚持点含贝类的高汤鱼菜,理由是 ChatGPT 说没有贝类;酒侍也常被顾客用 ChatGPT 取代。Meta 新 AI 智能体 Muse 的推出可能加剧这一问题。

9月30日周三
9月29日周二