跳到正文
原文
rohanpaul_ai· @rohanpaul_ai · X·· 1 天前AI 评分74

Anthropic 发布 Claude Haiku 5.5,成本较 Haiku 4.5 降低 90%

AI 导读

Anthropic 发布 Claude Haiku 5.5,在最高 100K token 的提示词上成本比 Haiku 4.5 低 90%,并新增首个 Haiku effort 设置,可在成本与准确率之间取舍;官方仍推荐 Sonnet 5.5 和 Opus 5.5 处理 Terminal-Bench 4.0 这类复杂 agentic coding 任务。

正文 · AI 翻译

Anthropic 发布了 Haiku 5.5。

> 在最高 100K token 的提示词上,成本比 Haiku 4.5 低 90%。

> Haiku 5.5 新增了首个 Haiku effort(努力程度)设置,以成本换取准确性,但 Anthropic 仍推荐在复杂的 agentic 编码(如 Terminal-Bench 4.0 任务)中使用 Sonnet 5.5 和 Opus 5.5。

> Asana 报告称,任务完成延迟降低了 30% 以上,每个 agent 轮次的推理速度比其当前模型快至多 2.5 倍。

> 在 OSWorld 2.1 上(该测试考察 AI agent 能否操作真实计算机完成长程多步任务),Haiku 5.5 从 Haiku 4.5 的 15.7% 跃升至 72.4%。

在 Chartography 上(一项在不使用工具的情况下阅读和解读图表的视觉推理测试),其成绩从 6.4% 提升至 46.4%。

来源:rohanpaul_ai · x.com