Benchmark

SWE-Atlas Refactoring

code text
语言EN
满分1
参评模型11

模型排名

名次 模型 机构 分数 来源
1 Claude Opus 4.7 Anthropic 48.6 来源 ↗
2 GPT-5.5 OpenAI 44.8 来源 ↗
3 GPT-5.4 OpenAI 44.3 来源 ↗
4 GPT-5.3 Codex OpenAI 42.4 来源 ↗
5 Claude Opus 4.6 Anthropic 35.6 来源 ↗
6 Gemini 3.1 Pro Preview Google 33.8 来源 ↗
7 Claude Sonnet 4.6 Anthropic 32.2 来源 ↗
8 GLM-5 Zhipu AI 24.2 来源 ↗
9 Kimi K2.5 Moonshot AI 21.0 来源 ↗
10 MiniMax-M2.5 MiniMax 19.5 来源 ↗
11 Gemini 3 Flash Preview Google 10.0 来源 ↗