跳到正文
原文
The Decoder· Matthias Bastian·· 7 小时前AI 评分64

研究发现 AI 智能体团队消耗大量 token 但质量提升有限

AI 导读

Evals 公司 Vals AI 在 Vibe Code Bench 上测试 GPT-6 Sol 和 Claude Opus 5.5 的单智能体与团队模式,团队成本高出 1.8x 至 5.1x,但四组对比中仅 GPT-6 Sol 在中等推理档有统计显著提升(团队高 7.3 分),最高推理档下团队无明显优势。

当前提供 AI 导读,完整正文请阅读原文。

来源:The Decoder · the-decoder.com