Benchmark

SWE-Atlas Test Writing

code text
语言EN
满分1
参评模型10

模型排名

名次 模型 机构 分数 来源
1 GPT-5.4 OpenAI 44.4 来源 ↗
2 GPT-5.5 OpenAI 42.6 来源 ↗
3 GPT-5.3 Codex OpenAI 39.0 来源 ↗
4 Claude Opus 4.6 Anthropic 36.7 来源 ↗
5 Claude Sonnet 4.6 Anthropic 31.8 来源 ↗
6 Gemini 3 Flash Preview Google 30.3 来源 ↗
7 Gemini 3.1 Pro Preview Google 29.8 来源 ↗
8 GLM-5 Zhipu AI 28.7 来源 ↗
9 Kimi K2.5 Moonshot AI 25.8 来源 ↗
10 MiniMax-M2.5 MiniMax 18.6 来源 ↗