Strong on Long Context; capable on Reasoning and Agentic +1 more; limited on Coding and Factuality — at $0.10/M input. Insufficient data on 4 of 10 axes.
| Provider | Model name | Input $/M | Output $/M | Effective | Current |
|---|---|---|---|---|---|
| direct ↗ | agnes-2-5-pro-beta | $0.10 | $0.30 | 2026-09-01 | ● |
| Benchmark | Score | Settings | Source | Verification | Methodology | Measured | Reference |
|---|---|---|---|---|---|---|---|
aa_agentic_index | 43.77 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ |
aa_intelligence_index | 49.10 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ |
aa_lcr | 78.00 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ |
aa_omniscience | -10.53 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ |
aa_coding_index | 62.30 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ |
| 15.71 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ | |
| 47.70 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ | |
gpqa | 90.51 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ |
aa_hle | 37.53 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ |
aa_mmmu_pro | 75.43 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ |
omniscienceAccuracy | 16.77 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ |
omniscienceNonHallucination | 67.20 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ |
aa_scicode | 47.57 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ |
tauBanking | 35.67 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ |
terminalbenchV21 | 69.66 | reasoning | artificialanalysis.ai | AGGREGATOR | AGGR | 10h ago | view ↗ |