OpenAI News·2025-02-18 18:00· 2025-02-18AI 评分42OpenAI 推出 SWE-Lancer 基准测试Introducing the SWE-Lancer benchmarkAI 导读OpenAI 发布 SWE-Lancer 基准测试,旨在评估前沿大语言模型在真实世界自由职业软件工程任务中的表现。该基准核心问题是检验 LLM 能否通过完成此类任务赚取 100 万美元收入。来源:OpenAI News · openai.com#评测/基准#编码#OpenAI