LLM leaderboard

Every tracked language model by intelligence, with what it costs and how fast it answers.

Claude Opus 5 (Adaptive Reasoning, Max Effort) leads from Anthropic, ahead of 610 others.

  1. 1Anthropic

    Claude Opus 5 (Adaptive Reasoning, Max Effort)

    63.10 intelligence

  2. 2Anthropic

    Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)

    62.50 intelligence

  3. 3Anthropic

    Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)

    62.10 intelligence

ranked by intelligence · 611 models · updated Aug 30 · 1–50

#ModelIntelligence
1Claude Opus 5 (Adaptive Reasoning, Max Effort)
63.10
2Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
62.50
3Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
62.10
4Claude Opus 5 (Adaptive Reasoning, High Effort)
61.50
5Grok 4.6 (high)
60.90
6GPT-5.6 Sol (max)
60.90
7Grok 4.6 (xhigh)
60.00
8Kimi K3 (max)
59.70
9GLM-5.3 (max)
59.50
10Grok 4.6 (medium)
59.00
11GPT-5.6 Sol (xhigh)
59.00
12Claude Opus 5 (Adaptive Reasoning, Medium Effort)
58.60
13Qwen3.8 Max
58.10
14Qwen3.8 2.4T A95B
57.70
15GLM-5.3-Flash
57.50
16GPT-5.6 Sol (high)
57.30
17Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
57.30
18Muse Spark 1.2 (xhigh)
56.80
19GPT-5.6 Terra (max)
56.60
20GPT-5.5 (xhigh)
56.30
21Gemini 3.7 Flash (high)
56.00
22Grok 4.5 (high)
55.80
23Qwen3.8-Flash-Next
55.80
24GPT-5.6 Sol (medium)
55.60
25Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
55.30
26Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
55.00
27GPT-5.5 (high)
54.70
28Gemini 3.7 Flash (medium)
53.40
29DeepSeek V4 Pro 0813 (Reasoning, Max Effort)
53.20
30Muse Spark 1.1 (xhigh)
53.20
31GPT-5.4 (xhigh)
53.10
32GPT-5.6 Terra (xhigh)
52.80
33GLM-5.2 (max)
52.60
34Claude Opus 5 (Adaptive Reasoning, Low Effort)
52.50
35GPT-5.6 Luna (max)
52.30
36Gemini 3.5 Flash (high)
52.00
37Qwen3.8 27B (xhigh)
52.00
38DeepSeek V4 Flash 0731 (Reasoning, Max Effort)
51.80
39Grok 4.6 (low)
51.70
40Gemini 3.6 Flash (high)
51.60
41DeepSeek V4 Flash Vision (Reasoning, Max Effort)
51.50
42GPT-5.5 (medium)
51.40
43Gemini 3.7 Flash (low)
50.90
44GPT-5.6 Sol (low)
50.70
45GPT-5.6 Terra (high)
50.10
46GPT-5.6 Luna (xhigh)
50.10
47Agnes 2.5 Pro Beta
49.10
48Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)
48.40
49Kimi K3 (low)
48.30
50Gemini 3.1 Pro Preview
47.70

what intelligence means

A composite of nine independent evaluations covering reasoning, coding, agentic work and knowledge. Higher is better. It is versioned, so scores are comparable within a version rather than across all time.