BenchLeader

Quality: the BenchLeader Index

Composite of every quality benchmark, normalised per benchmark and averaged per category. Requires results on at least five benchmarks across two categories.

610 models · data as of 9 Sept 2026

610 of 610
#
1GPT-6 AstraOpenAI70.6
2Claude Fable 5Anthropic70.4
3Claude Fable 5.1Anthropic70.3
4Claude Fable 5.1Anthropic70.2
5Claude Opus 5Anthropic70.0
6Claude Fable 5.1Anthropic70.0
7GPT-6 AstraOpenAI69.9
8Claude Fable 5.1Anthropic69.7
9GPT-6 AstraOpenAI69.5
10Claude Opus 5Anthropic69.3
11GPT-6 AstraOpenAI68.6
12GPT-5.6 SolOpenAI68.0
13Claude Fable 5.1Anthropic68.0
14GPT-5.6 SolOpenAI67.5
15GPT-6 AstraOpenAI67.4
16Claude Opus 5Anthropic66.8
17GPT-5.5OpenAI66.6
18Kimi K3Moonshot AIopen66.5
19GPT-5.5OpenAI66.3
20Claude Opus 5Anthropic66.3
21GPT-5.6 SolOpenAI66.0
22Claude Fable 5.1Anthropic65.9
23Claude Fable 5Anthropic65.8
24GPT-6 AstraOpenAI65.8
25Claude Opus 4.7Anthropic65.5
26GPT-5.6 SolOpenAI65.5
27Muse SparkMeta65.4
28GPT-5.6 SolOpenAI65.3
29Muse Spark 1.1Meta64.9
30GPT-5.5OpenAI64.9
31Claude Opus 4.8Anthropic64.7
32GPT-5.6 SolOpenAI64.6
33GPT-6 AstraOpenAI64.4
34Gemini 3.7 FlashGoogle64.4
35GPT-5.6 TerraOpenAI64.2
36GPT-5.4 ProOpenAI64.2
37Gemini 3.1 ProGoogle63.9
38Qwen3 8Alibaba63.9
39Gemini 3.5 FlashGoogle63.9
40Claude Fable 5Anthropic63.9
41Muse Spark 1.3Meta63.9
42Grok 4.6xAI63.8
43GPT-5.5OpenAI63.7
44Grok 4.6xAI63.6
45Gemini 3.8 FlashGoogle63.5
46GPT-5.4OpenAI63.4
47Grok 4.5xAI63.4
48Claude Opus 4.6Anthropic63.1
49GPT-5.6 TerraOpenAI63.1
50Claude Opus 5Anthropic63.1
51Kimi K3Moonshot AIopen62.7
52Muse Spark 1.2Meta62.6
53Gemini 3.7 FlashGoogle62.5
54GPT-5.3 CodexOpenAI62.4
55Gemini 3.8 FlashGoogle62.4
56Grok 4.6xAI62.3
57GPT-5.5OpenAI62.3
58GPT-5.6 TerraOpenAI62.3
59Claude Opus 4.6Anthropic62.3
60Qwen3 6Alibaba62.0