Reasoning-first Gemini preview for agentic coding and complex problem solving
发布日期2026年2月19日
参数规模—
上下文长度1.0M
许可证Proprietary
知识截止2025年1月1日
Benchmarks
评测成绩
| 评测基准 | 类别 | 分数 | 来源 |
|---|---|---|---|
| GDPval-AA | general | 13.1 | 来源 |
| GPQA Diamond | general | 94.3 | 来源 |
| CharXiv Reasoning | general | 83.3 | 来源 |
| MMMU Pro | vision multimodal reasoning general | 80.5 | 来源 |
| MCP Atlas | general | 78.2 | 来源 |
| ARC-AGI-2 | general | 77.1 | 来源 |
| OSWorld-Verified | general | 76.2 | 来源 |
| Terminal-Bench (Terminus-2) | reasoning code | 70.3 | 来源 |
| Terminal-Bench (Gemini CLI) | reasoning code | 68.3 | 来源 |
| SWE-Bench Pro | code | 54.2 | 来源 |
| SWE-Bench Pro | code | 46.1 | 来源 |
| SWE-Atlas Codebase QnA (Gemini CLI) | code | 45.6 | 来源 |
| Humanity's Last Exam | general | 44.4 | 来源 |
| Artificial Analysis Coding Agent Index | code | 43.0 | 来源 |
| SWE-Atlas Refactoring | code | 33.8 | 来源 |
| SWE-Atlas Test Writing | code | 29.8 | 来源 |
| SWE-Bench Pro (Gemini CLI) | code | 15.1 | 来源 |
| SWE-Atlas Codebase QnA (Mini-SWE-Agent) | code | 13.5 | 来源 |
Pricing
API 价格对比
| 服务商 | 输入价 | 输出价 | 上下文 | 吞吐(tok/s) | 延迟(s) | 函数调用 | 代码执行 | 联网搜索 |
|---|---|---|---|---|---|---|---|---|
| Abacus | $2.00 | $12.00 | 1.0M | — | — | ✓ | ✗ | ✗ |
| AIHubMix | $2.00 | $12.00 | 1.0M | — | — | ✓ | ✗ | ✗ |
| Auriko | $2.00 | $12.00 | 1.0M | — | — | ✓ | ✗ | ✗ |
| DaoXE | $2.00 | $12.00 | 1.0M | — | — | ✓ | ✗ | ✗ |
| GitHub Copilot | $2.00 | $12.00 | 936K | — | — | ✓ | ✗ | ✗ |
| $2.00 | $12.00 | 1.0M | — | — | ✓ | ✗ | ✗ | |
| Vertex | $2.00 | $12.00 | 1.0M | — | — | ✓ | ✗ | ✗ |
| LLM Gateway | $2.00 | $12.00 | 1.0M | — | — | ✓ | ✗ | ✗ |
| Vivgrid | $2.00 | $12.00 | 1.0M | — | — | ✓ | ✗ | ✗ |
价格单位:美元/百万 token,数据来自社区整理,仅供参考。