Benchmark

CFEval

code text

CFEval benchmark for evaluating code generation and problem-solving capabilities

语言EN
满分10000
参评模型2

模型排名

名次 模型 机构 分数 来源
1 Qwen3-235B-A22B-Thinking-2507 Alibaba Cloud / Qwen Team 21.3 来源 ↗
2 Qwen3-Next-80B-A3B-Thinking Alibaba Cloud / Qwen Team 20.7 来源 ↗