BenchLeader

AA-Omniscience

Knowledge recall that penalises hallucination: correct answers minus confident wrong ones, from −100 to 100. Run by Artificial Analysis.

Published by
Artificial Analysis
Category
Knowledge
Index weight
1.0
Models
472
Data as of
9 Sept 2026

Source: Artificial Analysis (artificialanalysis.ai). Data taken from the public leaderboard.

472 of 472
#
1GPT-6 AstraOpenAI43.769.5
2Claude Fable 5.1Anthropic43.5Claude Fable 5.1 (max with fallback)70.0
3GPT-6 AstraOpenAI43.468.6
4GPT-6 AstraOpenAI43.4GPT-6 Astra (max)69.9
5Claude Fable 5Anthropic43.3Claude Fable 5 (with fallback)70.4
6Claude Fable 5.1Anthropic42.470.3
7GPT-6 AstraOpenAI42.267.4
8Claude Fable 5.1Anthropic40.869.7
9GPT-6 AstraOpenAI40.565.8
10Claude Fable 5.1Anthropic37.668.0
11Claude Opus 5Anthropic37.1Claude Opus 5 (max)70.0
12Claude Opus 5Anthropic35.466.3
13Claude Fable 5.1Anthropic34.165.9
14Claude Opus 5Anthropic33.769.3
15Gemini 3.1 ProGoogle31.963.9
16Claude Opus 5Anthropic31.063.1
17Grok 4.6xAI30.5Grok 4.6 (high)63.6
18Gemini 3.8 FlashGoogle29.6Gemini 3.8 Flash (high)62.4
19Grok 4.6xAI29.362.3
20Claude Opus 4.8Anthropic28.8Claude Opus 4.8 (max)64.7
21Gemini 3.8 FlashGoogle28.663.5
22Claude Opus 5Anthropic28.661.7
23Muse Spark 1.1Meta28.1Muse Spark 1.1 (xhigh)64.9
24Grok 4.6xAI2863.8
25Claude Opus 4.7Anthropic27.3Claude Opus 4.7 (max)65.5
26Muse Spark 1.2Meta27.2Muse Spark 1.2 (xhigh)62.6
27GPT-6 AstraOpenAI26.664.4
28Gemini 3.7 FlashGoogle26.5Gemini 3.7 Flash (high)61.7
29Grok 4.6xAI25.959.6
30Grok 4.5xAI25.3Grok 4.5 (high)63.4
31Muse Spark 1.3Meta25Muse Spark 1.3 (max)
32Gemini 3.7 FlashGoogle23.764.4
33Muse Spark 1.3Meta23.163.9
34Gemini 3.7 FlashGoogle22.162.5
35Gemini 3.6 FlashGoogle22.1Gemini 3.6 Flash60.7
36GPT-5.6 SolOpenAI22.0GPT-5.6 Sol (max)65.3
37Gemini 3.8 FlashGoogle21.461.9
38Gemini 3.5 FlashGoogle21.2Gemini 3.5 Flash60.7
39GPT-5.6 SolOpenAI21.067.5
40Gemini 3.5 FlashGoogle20.863.9
41GPT-5.5OpenAI20.5GPT-5.5 (xhigh)66.6
42GPT-5.6 SolOpenAI20.468.0
43Kimi K3Moonshot AIopen19.7Kimi K3 (max)66.5
44GPT-5.6 SolOpenAI19.466.0
45GPT-5.6 SolOpenAI18.964.6
46GPT-5.5OpenAI18.866.3
47GPT-5.5OpenAI18.164.9
48Grok 4.3xAI18.0Grok 4.3 (high)57.8
49Grok 4.3xAI16.760.7
50Claude Sonnet 5Anthropic16.4Claude Sonnet 5 (max)61.2
51Gemini 3 ProGoogle15.3Gemini 3 Pro Preview (high)61.6
52GPT-5.5OpenAI15.162.3
53Claude Opus 4.7Anthropic14.860.1
54Grok 4.20xAI14.8Grok 4.20 0309 v257.9
55GLM-5.3Zhipu AIopen14.3GLM-5.3 (max)
56Claude Opus 4.5Anthropic1460.6
57Grok 4.3xAI13.959.5
58Claude Opus 4.6Anthropic13.763.1
59Qwen3 7Alibaba13.558.9
60Claude Sonnet 4.6Anthropic12.260.3