rohanpaul_ai· @rohanpaul_ai · X·· 1 天前AI 评分
Anthropic 发布 Claude Haiku 5.5,成本较 Haiku 4.5 降低 90%
Anthropic 发布 Claude Haiku 5.5,在最高 100K token 的提示词上成本比 Haiku 4.5 低 90%,并新增首个 Haiku effort 设置,可在成本与准确率之间取舍;官方仍推荐 Sonnet 5.5 和 Opus 5.5 处理 Terminal-Bench 4.0 这类复杂 agentic coding 任务。
Anthropic 发布了 Haiku 5.5。
> 在最高 100K token 的提示词上,成本比 Haiku 4.5 低 90%。
> Haiku 5.5 新增了首个 Haiku effort(努力程度)设置,以成本换取准确性,但 Anthropic 仍推荐在复杂的 agentic 编码(如 Terminal-Bench 4.0 任务)中使用 Sonnet 5.5 和 Opus 5.5。
> Asana 报告称,任务完成延迟降低了 30% 以上,每个 agent 轮次的推理速度比其当前模型快至多 2.5 倍。
> 在 OSWorld 2.1 上(该测试考察 AI agent 能否操作真实计算机完成长程多步任务),Haiku 5.5 从 Haiku 4.5 的 15.7% 跃升至 72.4%。
在 Chartography 上(一项在不使用工具的情况下阅读和解读图表的视觉推理测试),其成绩从 6.4% 提升至 46.4%。
来源:rohanpaul_ai · x.com