跳到正文
原文
OpenAI News·· 2025-02-18AI 评分38

OpenAI 发布 SWE-Lancer 基准测试

AI 导读

OpenAI 推出 SWE-Lancer 基准测试,用于检验前沿 LLM 能否完成真实自由职业软件工程任务并赚取 100 万美元。该基准围绕真实外包项目设计,衡量模型在实际软件工程工作中的表现。

当前提供 AI 导读,完整正文请阅读原文。

来源:OpenAI News · openai.com