Benchmark
DeepSWE
code
text
语言EN
满分1
参评模型5
模型排名
| 名次 | 模型 | 机构 | 分数 | 来源 |
|---|---|---|---|---|
| 1 | GPT-5.6 Sol | OpenAI | 72.7 | 来源 ↗ |
| 2 | GPT-5.6 Terra | OpenAI | 69.6 | 来源 ↗ |
| 3 | GPT-5.6 Luna | OpenAI | 67.2 | 来源 ↗ |
| 4 | Grok 4.5 | xAI | 62.0 | 来源 ↗ |
| 5 | Muse Spark 1.1 | Meta | 53.3 | 来源 ↗ |