Model Rankings
Overall score across all four complexity levels, weighted equally.
financebenchmark.ai · Pave
🥇
AnthropicClaude Opus 4.773.0%
🥈
OpenAIGPT-5.571.0%
🥉
GoogleGemini 3.1 Pro69.0%
4
DeepSeekDeepSeek V4 ProOPEN65.0%
5
xAIGrok 4.368.0%
6
Moonshot AIKimi K2.6OPEN66.0%
7
Zhipu AIGLM-5.1OPEN63.0%
8
MiniMaxMiniMax M2.7OPEN62.0%
Full Results Table
| # | Model | Overall | Level 1 | Level 2 | Level 3 | Level 4 | Source | Date |
|---|---|---|---|---|---|---|---|---|
| 🥇 | Anthropic | 73.0 | 96.0 | 75.0 | 52.0 | 68.0 | FinanceBenchmark (2026) | 2026-05 |
| 🥈 | OpenAI | 71.0 | 95.0 | 72.0 | 50.0 | 66.0 | FinanceBenchmark (2026) | 2026-05 |
| 🥉 | Google | 69.0 | 94.0 | 70.0 | 48.0 | 65.0 | FinanceBenchmark (2026) | 2026-05 |
| 4 | xAI | 68.0 | 93.0 | 68.0 | 47.0 | 63.0 | FinanceBenchmark (2026) | 2026-05 |
| 5 | Moonshot AI | 66.0 | 92.0 | 66.0 | 45.0 | 61.0 | FinanceBenchmark (2026) | 2026-05 |
| 6 | DeepSeek | 65.0 | 91.0 | 65.0 | 44.0 | 60.0 | FinanceBenchmark (2026) | 2026-05 |
| 7 | Zhipu AI | 63.0 | 90.0 | 63.0 | 42.0 | 58.0 | FinanceBenchmark (2026) | 2026-05 |
| 8 | MiniMax | 62.0 | 89.0 | 61.0 | 40.0 | 56.0 | FinanceBenchmark (2026) | 2026-05 |