Benchmark

DeepSWE

code text
语言EN
满分1
参评模型5

模型排名

名次 模型 机构 分数 来源
1 GPT-5.6 Sol OpenAI 72.7 来源 ↗
2 GPT-5.6 Terra OpenAI 69.6 来源 ↗
3 GPT-5.6 Luna OpenAI 67.2 来源 ↗
4 Grok 4.5 xAI 62.0 来源 ↗
5 Muse Spark 1.1 Meta 53.3 来源 ↗