Best AI for knowledge
Ranked by SimpleQA Verified, the one knowledge benchmark in the composite. Full leaderboard.
| Rank | Model | Lab | Composite | Evidence | Out $/M |
|---|---|---|---|---|---|
| 1 | GPT-6 Astra | OpenAI | 100th | 11 bench · 2 src | $50.00 |
| 2 | Gemini 3.1 Pro Preview | 99th | 12 bench · 2 src | $12.00 | |
| 3 | Claude Fable 5.1 | Anthropic | 97th | 10 bench · 2 src | $50.00 |
| 4 | Claude Fable 5 | Anthropic | 96th | 14 bench · 2 src | $50.00 |
| 5 | GPT-5.6 Sol | OpenAI | 94th | 12 bench · 2 src | $10.00 |
| 6 | Gemini 3.8 Flash | 93rd | 8 bench · 2 src | $3.75 | |
| 7 | Gemini 3.7 Flash | 92nd | 8 bench · 2 src | $3.75 | |
| 8 | Gemini 3 Flash Preview | 90th | 10 bench · 2 src | $3.00 | |
| 9 | Gemini 3.6 Flash | 89th | 8 bench · 2 src | $3.75 | |
| 10 | Gemini 3.5 Flash | 87th | 14 bench · 3 src | $9.00 | |
| 11 | GPT-5.5 | OpenAI | 86th | 16 bench · 2 src | $30.00 |
| 12 | Muse Spark 1.2 | Meta | 85th | 2 bench · 2 src | $4.25 |
| 13 | Claude Opus 5 | Anthropic | 83rd | 9 bench · 2 src | $25.00 |
| 14 | Muse Spark 1.1 | Meta | 82nd | 2 bench · 2 src | $4.25 |
| 15 | Qwen3.7-Max | Alibaba | 80th | 10 bench · 2 src | $9.00 |
| 16 | Claude Opus 4.8 | Anthropic | 79th | 13 bench · 2 src | $25.00 |
| 17 | DeepSeek V4 Pro 0813 | DeepSeek | 78th | 8 bench · 2 src | $4.0077 |
| 18 | Qwen3.6 Max Preview | Alibaba | 76th | 7 bench · 1 src | free |
| 19 | Claude Opus 4.7 | Anthropic | 75th | 13 bench · 2 src | $25.00 |
| 20 | Kimi K3 | Kimi | 73rd | 8 bench · 2 src | free |
| 21 | GPT 5 | OpenAI | 72nd | 13 bench · 3 src | $10.00 |
| 22 | o3 | OpenAI | 70th | 11 bench · 3 src | $8.00 |
| 23 | Grok 4.6 | xAI | 69th | 9 bench · 2 src | $6.00 |
| 24 | Qwen3 Max | Alibaba | 68th | 7 bench · 1 src | $6.001 |
| 25 | Grok 4.5 | xAI | 66th | 7 bench · 2 src | $6.00 |
| 26 | GPT 5.1 | OpenAI | 65th | 8 bench · 2 src | $10.00 |
| 27 | Qwen3.8 Max (0902) | Alibaba | 63rd | 6 bench · 1 src | — |
| 28 | Claude Opus 4.6 | Anthropic | 62nd | 11 bench · 2 src | $25.00 |
| 29 | DeepSeek v4 | DeepSeek | 61st | 7 bench · 1 src | — |
| 30 | GPT-5.4 Pro | OpenAI | 59th | 6 bench · 1 src | $180.00 |
| 31 | Qwen3.8 Max | Alibaba | 58th | 8 bench · 2 src | $6.00 |
| 32 | Claude Opus 4.5 | Anthropic | 56th | 11 bench · 2 src | $25.00 |
| 33 | GPT-5.4 | OpenAI | 55th | 13 bench · 2 src | $15.00 |
| 34 | Qwen3.6 Plus | Alibaba | 54th | 9 bench · 2 src | $3.00 |
| 35 | GPT-5.6 Terra | OpenAI | 52nd | 8 bench · 2 src | $12.00 |
| 36 | o1-2024-12-17 | OpenAI | 51st | 9 bench · 3 src | $60.00 |
| 37 | GPT-5.6 Luna | OpenAI | 49th | 8 bench · 2 src | $0.37 |
| 38 | GLM-5.3 | Zhipu | 48th | 8 bench · 2 src | $4.40 |
| 39 | Qwen3-235B-A22B | Alibaba | 47th | 7 bench · 1 src | — |
| 40 | Inkling | Thinking Machines | 45th | 7 bench · 2 src | $4.05 |
| 41 | Kimi K2.7 Code | Kimi | 44th | 7 bench · 2 src | $4.389 |
| 42 | Kimi K2.6 | Kimi | 42nd | 12 bench · 2 src | $4.00 |
| 43 | Kimi K2.5 | Kimi | 41st | 7 bench · 2 src | $1.90 |
| 44 | GLM-5.2 | Zhipu | 39th | 10 bench · 2 src | $4.40 |
| 45 | Claude Sonnet 4.6 | Anthropic | 38th | 8 bench · 2 src | $15.94 |
| 46 | GLM-5.1 | Zhipu | 37th | 8 bench · 1 src | $4.40 |
| 47 | DeepSeek V4 Flash 0731 | DeepSeek | 35th | 8 bench · 2 src | $0.50 |
| 48 | GPT 5.2 | OpenAI | 34th | 12 bench · 3 src | $14.00 |
| 49 | Claude Sonnet 5 | Anthropic | 32nd | 8 bench · 2 src | $10.00 |
| 50 | Grok 4.3 Beta | xAI | 31st | 6 bench · 1 src | — |
| 51 | GLM-4.7 | Zhipu | 30th | 6 bench · 1 src | $0.80 |
| 52 | GPT 4.1 | OpenAI | 28th | 10 bench · 3 src | $8.00 |
| 53 | Claude Sonnet 4.5 | Anthropic | 27th | 10 bench · 1 src | $15.00 |
| 54 | Grok 4.20 | xAI | 25th | 6 bench · 1 src | $6.00 |
| 55 | GPT-5.4 mini | OpenAI | 24th | 10 bench · 2 src | $4.50 |
| 56 | GPT 4o | OpenAI | 23rd | 9 bench · 3 src | $10.00 |
| 57 | Qwen3.5 Plus | Alibaba | 21st | 7 bench · 1 src | $2.40 |
| 58 | Claude Sonnet 4.5 | Anthropic | 20th | 8 bench · 1 src | — |
| 59 | GPT 5 mini | OpenAI | 18th | 11 bench · 2 src | $2.00 |
| 60 | Qwen3.5 Flash | Alibaba | 17th | 8 bench · 1 src | $0.40 |
| 61 | o4-mini | OpenAI | 16th | 12 bench · 3 src | $4.40 |
| 62 | Inkling Small | Thinking Machines | 14th | 7 bench · 1 src | $1.20 |
| 63 | Qwen3.6 Flash | Alibaba | 13th | 8 bench · 1 src | $1.16 |
| 64 | O3 Mini | OpenAI | 11th | 12 bench · 3 src | $4.40 |
| 65 | Claude Haiku 4.5 | Anthropic | 10th | 7 bench · 1 src | $5.00 |
| 66 | GPT 4.1 mini | OpenAI | 9th | 10 bench · 3 src | $1.60 |
| 67 | Claude 3 Opus | Anthropic | 7th | 6 bench · 2 src | $75.00 |
| 68 | GPT 5 nano | OpenAI | 6th | 11 bench · 2 src | $0.40 |
| 69 | GPT-5.4 nano | OpenAI | 4th | 10 bench · 2 src | $1.25 |
| 70 | Gemma 4 31B IT | 3rd | 4 bench · 1 src | $0.42 | |
| 71 | GPT-4o mini | OpenAI | 1st | 8 bench · 2 src | $0.60 |
| 72 | GPT-4.1 nano | OpenAI | 0th | 6 bench · 2 src | $0.40 |
Common questions
- What is the best ai for knowledge right now?
- Ranked by SimpleQA Verified, the one knowledge benchmark in the composite.
- How is this ranking computed?
- It is the same family composite as the leaderboard. Each benchmark is weighted by how much of its spread survives its own measurement error.