ArtificialAnlys· @ArtificialAnlys · X·· 4 天前AI 评分
Artificial Analysis 编码智能体榜单:Claude Sonnet 5.5 居首但成本最高
Artificial Analysis 发布 Coding Agent Index 榜单,本周发布的 Claude Sonnet 5.5、GPT-6.1 Sol 和 Gemini 4 Argon 均位居前列,但性能与成本的平衡各不相同。
本周,Claude Sonnet 5.5、GPT-6.1 Sol 和 Gemini 4 Argon 都在 Coding Agent Index 排行榜上名列前茅,但三者在性能与成本的平衡上各有不同。
Artificial Analysis Coding Agent Index 通过三项智能体编码评测,对智能体(模型与运行框架的组合)进行衡量。
➤ Claude Sonnet 5.5(max)在 Claude Code 中以 68 分位居榜首,但其单任务成本也是最高的,达 14.19 美元。
➤ Gemini 4 Argon(high)在 Antigravity CLI 中得分为 64,单任务成本为 5.84 美元——不到 Sonnet 5.5 成本的一半。请注意,这里使用的是 Google 的促销价格,且 Argon 尚未公开发布。
➤ GPT-6.1 Sol(xhigh)在 Codex 中得分为 63,单任务成本为 1.04 美元,约为 Argon 成本的六分之一。
来源:ArtificialAnlys · x.com