Benchmark
SWE-Atlas Test Writing
code
text
语言EN
满分1
参评模型10
模型排名
| 名次 | 模型 | 机构 | 分数 | 来源 |
|---|---|---|---|---|
| 1 | GPT-5.4 | OpenAI | 44.4 | 来源 ↗ |
| 2 | GPT-5.5 | OpenAI | 42.6 | 来源 ↗ |
| 3 | GPT-5.3 Codex | OpenAI | 39.0 | 来源 ↗ |
| 4 | Claude Opus 4.6 | Anthropic | 36.7 | 来源 ↗ |
| 5 | Claude Sonnet 4.6 | Anthropic | 31.8 | 来源 ↗ |
| 6 | Gemini 3 Flash Preview | 30.3 | 来源 ↗ | |
| 7 | Gemini 3.1 Pro Preview | 29.8 | 来源 ↗ | |
| 8 | GLM-5 | Zhipu AI | 28.7 | 来源 ↗ |
| 9 | Kimi K2.5 | Moonshot AI | 25.8 | 来源 ↗ |
| 10 | MiniMax-M2.5 | MiniMax | 18.6 | 来源 ↗ |