Trivia Ranking
See which AI models perform best on Trivia, which ones stay reliable, and where the biggest gaps appear.
343/343
Filter models
No models match the current search and filters.
| Rank | Model | Company | Trivia Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #158 | Claude Fable 5.1 low | Anthropic | 3.0 | 6.9 | $2.565 | 0/1 | 19.2s |
| #159 | Qwen3.7 Flash medium | Qwen | 3.0 | 6.9 | $0.065 | 0/1 | 29.2s |
| #160 | Seed-2.0-Code high | Bytedance Seed | 3.0 | 6.9 | $1.273 | 0/1 | 52.2s |
| #162 | Qwen3.6 Flash medium | Qwen | 3.0 | 6.8 | $0.741 | 0/1 | 122.9s |
| #163 | Step 3.7 Flash high | Stepfun | 3.0 | 6.8 | $1.229 | 0/1 | 149.3s |
| #164 | Seed-2.0-Code medium | Bytedance Seed | 3.0 | 6.8 | $1.153 | 0/1 | 66.6s |
| #165 | GLM 5.3 FlashX high | Z.ai | 3.0 | 6.8 | $0.135 | 0/1 | 5.34s |
| #166 | Solar Pro 4 low | Upstage | 3.0 | 6.8 | $0.130 | 0/1 | 69.2s |
| #167 | Solar Pro 4 medium | Upstage | 3.0 | 6.8 | $0.140 | 0/1 | 108.6s |
| #168 | DeepSeek V4 Pro none | DeepSeek | 3.0 | 6.8 | $0.196 | 0/1 | 5.76s |
| #169 | GLM 5.3 low | Z.ai | 3.0 | 6.8 | $0.167 | 0/1 | 7.42s |
| #170 | MiMo-V2.5-Pro medium | Xiaomi | 3.0 | 6.8 | $0.221 | 0/1 | 12.5s |
| #171 | Mercury 2.5 medium | Inception | 3.0 | 6.8 | $0.022 | 0/1 | 4.30s |
| #172 | Gemini 3 Flash Preview none | 3.0 | 6.8 | $0.085 | 0/1 | 1.07s | |
| #173 | Gemma 4 26B A4B medium | 3.0 | 6.8 | $0.084 | 0/1 | 180.9s |