Skip to main content
ModelScale

Knowledge benchmark

AA-Omniscience Index leaderboard

Artificial Analysis Omniscience Index. Every model the catalog carries a published AA-Omniscience Index value for, ranked by that value.

CategoryKnowledge
MeasureIndex score
TasksKnowledge questions
DifficultyBroad factual knowledge

A display-only Artificial Analysis factual knowledge index.

AA-Omniscience Index ranking

171 models with a published AA-Omniscience Index value, ordered by that value, highest first. Models the source has not scored on this benchmark are not listed — they are unmeasured, not last.

Models ranked by their published Artificial Analysis Omniscience Index value
RankModelProviderIndex score
1Claude Fable 5.1Anthropic43.5
2GPT-6 AstraOpenAI43.4
3Claude Fable 5Anthropic43.3
4Claude Opus 5Anthropic37.1
5Gemini 3.1 ProGoogle31.9
6Grok 4.6xAI30.5
7Gemini 3.8 FlashGoogle29.6
8Claude Opus 4.8Anthropic28.8
9Muse Spark 1.1Meta28.1
10Claude Opus 4.7 (Adaptive)Anthropic27.3
11Muse Spark 1.2Meta27.2
12Gemini 3.7 FlashGoogle26.5
13Grok 4.5xAI25.3
14Muse Spark 1.3Meta25.0
15Gemini 3.6 FlashGoogle22.1
16GPT-5.6 SolOpenAI22.0
17Gemini 3.5 FlashGoogle21.2
18GPT-5.5OpenAI20.5
19Kimi K3Moonshot AI19.7
20Grok 4.3xAI18.0
21Claude Sonnet 5Anthropic16.5
22Gemini 3 ProGoogle15.3
23Claude Opus 4.7Anthropic14.8
24GLM-5.3Z.AI14.3
25Claude Opus 4.5 ThinkingAnthropic14.0
26Claude Opus 4.6 (Adaptive)Anthropic13.7
27Qwen3.7 MaxAlibaba13.5
28Qwen3.8 Max PreviewAlibaba12.0
29GPT-5.3 CodexOpenAI10.9
30Qwen 3.6 Max (preview)Alibaba9.2
31GLM-5.3-FlashZ.AI7.5
32Muse SparkMeta7.2
33GPT-5.4OpenAI5.8
34GPT-5.1OpenAI5.4
35Kimi K2.6Moonshot AI5.3
36Gemini 3.5 Flash-LiteGoogle5.2
37MiMo-V2-ProXiaomi4.6
38GLM-5.2Z.AI4.4
39MiMo-V2.5-ProXiaomi3.3
40Claude Opus 4.6Anthropic2.4
41Grok 4xAI2.1
42TMInklingThinking Machines Lab2.0
43MiniMax M3MiniMax1.4
44Qwen3.7 PlusAlibaba1.1
45GLM-5.1Z.AI0.9
45Qwen3.6 PlusAlibaba0.9
47DeepSeek V4 Pro 0813DeepSeek0.8
47MiniMax M2.7MiniMax0.8
49GLM-5Z.AI0.3
50GPT-5.6 TerraOpenAI0.1
51Nemotron 3 UltraNVIDIA-0.4
52Solar Pro 4Upstage-0.8
53GPT-5.2OpenAI-0.9
54GPT-5.2-CodexOpenAI-2.2
55MCQuasar 438BMultiverse Computing-2.6
56Claude Sonnet 4.6Anthropic-3.5
57Command A+Cohere-4.0
58Claude Opus 4.5Anthropic-4.1
59Gemini 3 FlashGoogle-4.3
60Ling 3.0 Flash VLInclusionAI-4.5
61DeepSeek V4.1 FlashDeepSeek-5.3
62GPT-5.1-CodexOpenAI-6.5
62GPT-5.1-Codex-MaxOpenAI-6.5
64K-EXAONE 2.0LG AI Research-6.6
65Kimi K2.5Moonshot AI-7.3
65Kimi K2.5 (Reasoning)Moonshot AI-7.3
67STA.X K2SK Telecom-8.2
68GPT-5 (high)OpenAI-8.7
69TMInkling-SmallThinking Machines Lab-8.9
70Claude 4 SonnetAnthropic-9.0
71Qwen3.8-Flash-NextAlibaba-9.7
72Qwen3.8-27BAlibaba-10.0
73Kimi K2.7 CodeMoonshot AI-10.2
74GPT-5.6 LunaOpenAI-10.3
75GPT-4oOpenAI-10.5
76GPT-5 (medium)OpenAI-10.9
77o1OpenAI-11.0
78OPMiniCPM5-2BOpenBMB-11.6
79Granite 4.2 30BIBM-12.9
80DeepSeek V4 Flash 0731DeepSeek-14.3
81Granite 4.2 3BIBM-14.7
82o3OpenAI-15.5
83Gemini 2.5 ProGoogle-16.3
84GLM-5-TurboZ.AI-16.4
85Llama 3.1 405BMeta-17.1
86Granite 4.2 8BIBM-17.2
87Nemotron 3.5 Lightning 30B A3B NVFP4NVIDIA-17.7
88Ling 3.0 FlashInclusionAI-17.9
88Ling 3.0 Flash FP8InclusionAI-17.9
90Hy3Tencent-18.5
90Hy3 PreviewTencent-18.5
92GPT-5.4 miniOpenAI-18.9
93GLM-5V-TurboZ.AI-19.3
93Ling 3.0 TinyInclusionAI-19.3
95Gemma 4 E4BGoogle-19.7
96Qwen3.6-27BAlibaba-20.0
97MiMo-V2-OmniXiaomi-20.1
98APApodex 1.1Apodex-21.9
98APApodex 1.1 MiniApodex-21.9
100Qwen3.6-35B-A3BAlibaba-22.2
101Gemma 4 E2BGoogle-23.6
102DeepSeek-R1DeepSeek-27.4
103Kimi K2Moonshot AI-28.3
104GPT-5.4 nanoOpenAI-29.5
104LFM2.5-2.6BLiquidAI-29.5
106DeepSeek V3.1 (Reasoning)DeepSeek-29.6
107Grok 4 Fast (Reasoning)xAI-29.9
107Grok 4.1 Fast (Reasoning)xAI-29.9
109Mistral Small 4Mistral-30.4
109Mistral Small 4 (Reasoning)Mistral-30.4
111Mistral Medium 3Mistral-31.4
112GLM-4.6Z.AI-31.7
113Muse Glimmer 30BMeta-32.8
114LFM2.5-8B-A1BLiquidAI-33.3
115Mistral Large 2Mistral-34.4
116GLM-4.7Z.AI-36.4
117Mistral Medium 3.5 128BMistral-36.8
118Grok Code Fast 1xAI-37.1
119Step 3.7 FlashStepFun-37.3
120Qwen3.5 397BAlibaba-37.9
120Qwen3.5 397B (Reasoning)Alibaba-37.9
122GPT-4.1OpenAI-39.6
122Mistral Large 3Mistral-39.6
124Nemotron 3 Super 100BNVIDIA-41.5
124Qwen3.5-122B-A10BAlibaba-41.5
126DeepSeek V3DeepSeek-41.6
127Llama 4 MaverickMeta-41.8
128Gemini 2.5 FlashGoogle-42.6
129DeepSeek V3.1DeepSeek-42.7
130Qwen3 MaxAlibaba-43.5
131Qwen3.5-27BAlibaba-44.0
132Trinity-Large-PreviewArcee AI-44.1
132Trinity-Large-ThinkingArcee AI-44.1
134Nemotron Ultra 253BNVIDIA-44.9
135DeepSeek V3.2DeepSeek-46.9
136Nova ProAmazon-47.7
137Gemma 4 31BGoogle-47.9
138Qwen3.5-35B-A3BAlibaba-48.1
139MiMo-V2-FlashXiaomi-48.4
140Claude 3 HaikuAnthropic-48.6
140North Mini CodeCohere-48.6
142GPT-OSS 120BOpenAI-49.2
143Gemma 4 26B A4BGoogle-50.8
144Grok 4.1 FastxAI-50.9
145Nemotron 3 Nano 30BNVIDIA-51.6
146Llama 4 ScoutMeta-52.1
147Gemma 4 12BGoogle-52.7
148Solar Pro 3Upstage-53.4
149GPT-4.1 miniOpenAI-53.6
150FAUltravox v0.6 Llama 3.3 70BFixie AI-54.2
151Phi-4Microsoft-55.7
152Nemotron 3 Nano Omni 30B A3BNVIDIA-57.4
153GPT-4.1 nanoOpenAI-57.6
154K-ExaoneLG AI Research-58.0
155SASarvam 105BSarvam-59.4
156Qwen3-Omni-30B-A3B-ThinkingAlibaba-61.4
157GLM-4.5-AirZ.AI-61.5
158Solar Pro 2Upstage-62.0
159Exaone 4.0 32BLG AI Research-62.8
160GPT-OSS 20BOpenAI-63.0
161Ling 2.6 FlashInclusionAI-66.1
162Gemma 3 27BGoogle-67.2
163Granite-4.0-350MIBM-69.3
163Qwen3-Omni-30B-A3B-InstructAlibaba-69.3
165SASarvam 30BSarvam-71.5
166CECeleris-1Celeris-71.6
167Granite-4.0-H-1BIBM-72.3
168Granite-4.0-H-350MIBM-80.9
169Granite-4.0-1BIBM-81.6
170Exaone 4.0 1.2BLG AI Research-82.1
171LFM2.5-VL-1.6B-ExtractLiquidAI-84.4

Evidence key: ObservedLast good

Rows are ordered by the value AA-Omniscience: Knowledge and Hallucination Benchmark published, highest first. The source does not state whether a higher value is the better result, so this page does not either: for a benchmark that measures a rate of failure, read the table from the bottom.

All leaderboards · Knowledge capability leaderboard