Large coding-reasoning model for agentic software tasks and RL search
发布日期2026年6月25日
参数规模—
上下文长度—
许可证Open Weights
知识截止—
Benchmarks
评测成绩
| 评测基准 | 类别 | 分数 | 来源 |
|---|---|---|---|
| SWE-Bench Verified | reasoning frontend_development code | 75.6 | 来源 |
| Claw-eval | general | 69.8 | 来源 |
| SWE-Bench Multilingual | reasoning code | 69.3 | 来源 |
| Terminal-Bench 2.1 | code | 64.2 | 来源 |
| Terminal-Bench 2.1 | code | 62.8 | 来源 |
| SWE-Bench Pro | code | 50.4 | 来源 |
| NL2Repo | general | 34.6 | 来源 |
Pricing
API 价格对比
暂无 API 价格。