Multi-agent model for routing expert agents across complex analytical tasks
发布日期2026年6月15日
参数规模—
上下文长度—
许可证Proprietary
知识截止—
Benchmarks
评测成绩
| 评测基准 | 类别 | 分数 | 来源 |
|---|---|---|---|
| GPQA Diamond | general | 95.5 | 来源 |
| LiveCodeBench | reasoning general code | 92.9 | 来源 |
| LiveCodeBench Pro | code | 87.8 | 来源 |
| MRCRv2 | general | 86.6 | 来源 |
| CharXiv Reasoning | general | 85.1 | 来源 |
| Terminal Bench 2.1 | code | 80.2 | 来源 |
| Long Context Reasoning | general | 74.7 | 来源 |
| CTI-REALM | general | 67.5 | 来源 |
| SciCode | reasoning math physics chemistry code | 60.1 | 来源 |
| SWE Bench Pro | code | 59.0 | 来源 |
| Humanity’s Last Exam | general | 47.2 | 来源 |
| τ3 Banking | general | 21.7 | 来源 |
Pricing
API 价格对比
暂无 API 价格。