Benchmark
SWE-Atlas Codebase QnA
code
text
语言EN
满分1
参评模型14
模型排名
| 名次 | 模型 | 机构 | 分数 | 来源 |
|---|---|---|---|---|
| 1 | Claude Opus 4.7 | Anthropic | 81.0 | 来源 ↗ |
| 2 | GPT-5.5 | OpenAI | 80.8 | 来源 ↗ |
| 3 | GLM-5.1 | Zhipu AI | 73.2 | 来源 ↗ |
| 4 | GPT-5.4 | OpenAI | 72.9 | 来源 ↗ |
| 5 | Claude Opus 4.6 | Anthropic | 71.9 | 来源 ↗ |
| 6 | Claude Sonnet 4.6 | Anthropic | 70.3 | 来源 ↗ |
| 7 | DeepSeek V4 Pro | DeepSeek | 67.8 | 来源 ↗ |
| 8 | Kimi K2.6 | Moonshot AI | 59.8 | 来源 ↗ |
| 9 | Gemini 3.1 Pro Preview | 45.6 | 来源 ↗ | |
| 10 | GPT-5.3 Codex | OpenAI | 32.6 | 来源 ↗ |
| 11 | GLM-5 | Zhipu AI | 20.5 | 来源 ↗ |
| 12 | Kimi K2.5 | Moonshot AI | 13.1 | 来源 ↗ |
| 13 | MiniMax-M2.5 | MiniMax | 10.3 | 来源 ↗ |
| 14 | Gemini 3 Flash Preview | 8.2 | 来源 ↗ |