OpenAI News·2025-02-18 18:00· 2025-02-18AI 评分38OpenAI 发布 SWE-Lancer 基准测试AI 导读OpenAI 推出 SWE-Lancer 基准测试,用于检验前沿 LLM 能否完成真实自由职业软件工程任务并赚取 100 万美元。该基准围绕真实外包项目设计,衡量模型在实际软件工程工作中的表现。正文阅读原文 当前提供 AI 导读,完整正文请阅读原文。来源:OpenAI News · openai.com#评测/基准#编码#OpenAI