Benchmark

SWE-Atlas Codebase QnA

code text
语言EN
满分1
参评模型14

模型排名

名次 模型 机构 分数 来源
1 Claude Opus 4.7 Anthropic 81.0 来源 ↗
2 GPT-5.5 OpenAI 80.8 来源 ↗
3 GLM-5.1 Zhipu AI 73.2 来源 ↗
4 GPT-5.4 OpenAI 72.9 来源 ↗
5 Claude Opus 4.6 Anthropic 71.9 来源 ↗
6 Claude Sonnet 4.6 Anthropic 70.3 来源 ↗
7 DeepSeek V4 Pro DeepSeek 67.8 来源 ↗
8 Kimi K2.6 Moonshot AI 59.8 来源 ↗
9 Gemini 3.1 Pro Preview Google 45.6 来源 ↗
10 GPT-5.3 Codex OpenAI 32.6 来源 ↗
11 GLM-5 Zhipu AI 20.5 来源 ↗
12 Kimi K2.5 Moonshot AI 13.1 来源 ↗
13 MiniMax-M2.5 MiniMax 10.3 来源 ↗
14 Gemini 3 Flash Preview Google 8.2 来源 ↗