Knowledge benchmark
AA-Omniscience Index leaderboard
Artificial Analysis Omniscience Index. Every model the catalog carries a published AA-Omniscience Index value for, ranked by that value.
A display-only Artificial Analysis factual knowledge index.
AA-Omniscience Index ranking
171 models with a published AA-Omniscience Index value, ordered by that value, highest first. Models the source has not scored on this benchmark are not listed — they are unmeasured, not last.
| Rank | Model | Provider | Index score |
|---|---|---|---|
| 1 | Anthropic | 43.5 | |
| 2 | OpenAI | 43.4 | |
| 3 | Anthropic | 43.3 | |
| 4 | Anthropic | 37.1 | |
| 5 | 31.9 | ||
| 6 | xAI | 30.5 | |
| 7 | 29.6 | ||
| 8 | Anthropic | 28.8 | |
| 9 | Meta | 28.1 | |
| 10 | Anthropic | 27.3 | |
| 11 | Meta | 27.2 | |
| 12 | 26.5 | ||
| 13 | xAI | 25.3 | |
| 14 | Meta | 25.0 | |
| 15 | 22.1 | ||
| 16 | OpenAI | 22.0 | |
| 17 | 21.2 | ||
| 18 | OpenAI | 20.5 | |
| 19 | Moonshot AI | 19.7 | |
| 20 | xAI | 18.0 | |
| 21 | Anthropic | 16.5 | |
| 22 | 15.3 | ||
| 23 | Anthropic | 14.8 | |
| 24 | Z.AI | 14.3 | |
| 25 | Anthropic | 14.0 | |
| 26 | Anthropic | 13.7 | |
| 27 | Alibaba | 13.5 | |
| 28 | Alibaba | 12.0 | |
| 29 | OpenAI | 10.9 | |
| 30 | Alibaba | 9.2 | |
| 31 | Z.AI | 7.5 | |
| 32 | Meta | 7.2 | |
| 33 | OpenAI | 5.8 | |
| 34 | OpenAI | 5.4 | |
| 35 | Moonshot AI | 5.3 | |
| 36 | 5.2 | ||
| 37 | Xiaomi | 4.6 | |
| 38 | Z.AI | 4.4 | |
| 39 | Xiaomi | 3.3 | |
| 40 | Anthropic | 2.4 | |
| 41 | xAI | 2.1 | |
| 42 | TMInkling | Thinking Machines Lab | 2.0 |
| 43 | MiniMax | 1.4 | |
| 44 | Alibaba | 1.1 | |
| 45 | Z.AI | 0.9 | |
| 45 | Alibaba | 0.9 | |
| 47 | DeepSeek | 0.8 | |
| 47 | MiniMax | 0.8 | |
| 49 | Z.AI | 0.3 | |
| 50 | OpenAI | 0.1 | |
| 51 | NVIDIA | -0.4 | |
| 52 | Upstage | -0.8 | |
| 53 | OpenAI | -0.9 | |
| 54 | OpenAI | -2.2 | |
| 55 | MCQuasar 438B | Multiverse Computing | -2.6 |
| 56 | Anthropic | -3.5 | |
| 57 | Cohere | -4.0 | |
| 58 | Anthropic | -4.1 | |
| 59 | -4.3 | ||
| 60 | InclusionAI | -4.5 | |
| 61 | DeepSeek | -5.3 | |
| 62 | OpenAI | -6.5 | |
| 62 | OpenAI | -6.5 | |
| 64 | LG AI Research | -6.6 | |
| 65 | Moonshot AI | -7.3 | |
| 65 | Moonshot AI | -7.3 | |
| 67 | STA.X K2 | SK Telecom | -8.2 |
| 68 | OpenAI | -8.7 | |
| 69 | TMInkling-Small | Thinking Machines Lab | -8.9 |
| 70 | Anthropic | -9.0 | |
| 71 | Alibaba | -9.7 | |
| 72 | Alibaba | -10.0 | |
| 73 | Moonshot AI | -10.2 | |
| 74 | OpenAI | -10.3 | |
| 75 | OpenAI | -10.5 | |
| 76 | OpenAI | -10.9 | |
| 77 | OpenAI | -11.0 | |
| 78 | OPMiniCPM5-2B | OpenBMB | -11.6 |
| 79 | IBM | -12.9 | |
| 80 | DeepSeek | -14.3 | |
| 81 | IBM | -14.7 | |
| 82 | OpenAI | -15.5 | |
| 83 | -16.3 | ||
| 84 | Z.AI | -16.4 | |
| 85 | Meta | -17.1 | |
| 86 | IBM | -17.2 | |
| 87 | NVIDIA | -17.7 | |
| 88 | InclusionAI | -17.9 | |
| 88 | InclusionAI | -17.9 | |
| 90 | Tencent | -18.5 | |
| 90 | Tencent | -18.5 | |
| 92 | OpenAI | -18.9 | |
| 93 | Z.AI | -19.3 | |
| 93 | InclusionAI | -19.3 | |
| 95 | -19.7 | ||
| 96 | Alibaba | -20.0 | |
| 97 | Xiaomi | -20.1 | |
| 98 | APApodex 1.1 | Apodex | -21.9 |
| 98 | APApodex 1.1 Mini | Apodex | -21.9 |
| 100 | Alibaba | -22.2 | |
| 101 | -23.6 | ||
| 102 | DeepSeek | -27.4 | |
| 103 | Moonshot AI | -28.3 | |
| 104 | OpenAI | -29.5 | |
| 104 | LiquidAI | -29.5 | |
| 106 | DeepSeek | -29.6 | |
| 107 | xAI | -29.9 | |
| 107 | xAI | -29.9 | |
| 109 | Mistral | -30.4 | |
| 109 | Mistral | -30.4 | |
| 111 | Mistral | -31.4 | |
| 112 | Z.AI | -31.7 | |
| 113 | Meta | -32.8 | |
| 114 | LiquidAI | -33.3 | |
| 115 | Mistral | -34.4 | |
| 116 | Z.AI | -36.4 | |
| 117 | Mistral | -36.8 | |
| 118 | xAI | -37.1 | |
| 119 | StepFun | -37.3 | |
| 120 | Alibaba | -37.9 | |
| 120 | Alibaba | -37.9 | |
| 122 | OpenAI | -39.6 | |
| 122 | Mistral | -39.6 | |
| 124 | NVIDIA | -41.5 | |
| 124 | Alibaba | -41.5 | |
| 126 | DeepSeek | -41.6 | |
| 127 | Meta | -41.8 | |
| 128 | -42.6 | ||
| 129 | DeepSeek | -42.7 | |
| 130 | Alibaba | -43.5 | |
| 131 | Alibaba | -44.0 | |
| 132 | Arcee AI | -44.1 | |
| 132 | Arcee AI | -44.1 | |
| 134 | NVIDIA | -44.9 | |
| 135 | DeepSeek | -46.9 | |
| 136 | Amazon | -47.7 | |
| 137 | -47.9 | ||
| 138 | Alibaba | -48.1 | |
| 139 | Xiaomi | -48.4 | |
| 140 | Anthropic | -48.6 | |
| 140 | Cohere | -48.6 | |
| 142 | OpenAI | -49.2 | |
| 143 | -50.8 | ||
| 144 | xAI | -50.9 | |
| 145 | NVIDIA | -51.6 | |
| 146 | Meta | -52.1 | |
| 147 | -52.7 | ||
| 148 | Upstage | -53.4 | |
| 149 | OpenAI | -53.6 | |
| 150 | FAUltravox v0.6 Llama 3.3 70B | Fixie AI | -54.2 |
| 151 | Microsoft | -55.7 | |
| 152 | NVIDIA | -57.4 | |
| 153 | OpenAI | -57.6 | |
| 154 | LG AI Research | -58.0 | |
| 155 | SASarvam 105B | Sarvam | -59.4 |
| 156 | Alibaba | -61.4 | |
| 157 | Z.AI | -61.5 | |
| 158 | Upstage | -62.0 | |
| 159 | LG AI Research | -62.8 | |
| 160 | OpenAI | -63.0 | |
| 161 | InclusionAI | -66.1 | |
| 162 | -67.2 | ||
| 163 | IBM | -69.3 | |
| 163 | Alibaba | -69.3 | |
| 165 | SASarvam 30B | Sarvam | -71.5 |
| 166 | CECeleris-1 | Celeris | -71.6 |
| 167 | IBM | -72.3 | |
| 168 | IBM | -80.9 | |
| 169 | IBM | -81.6 | |
| 170 | LG AI Research | -82.1 | |
| 171 | LiquidAI | -84.4 |
Evidence key: ObservedLast good
Rows are ordered by the value AA-Omniscience: Knowledge and Hallucination Benchmark published, highest first. The source does not state whether a higher value is the better result, so this page does not either: for a benchmark that measures a rate of failure, read the table from the bottom.