Trivia Ranking
See which AI models perform best on Trivia, which ones stay reliable, and where the biggest gaps appear. Sort by: Total Cost ↓.
343/343
Filter models
No models match the current search and filters.
| Rank | Model | Company | Trivia Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #275 | Qwen3.6 35B A3B none | Qwen | 3.0 | 5.3 | $0.061 | 0/1 | 414ms |
| #182 | Qwen3.5-27B none | Qwen | 3.0 | 6.6 | $0.058 | 0/1 | 599ms |
| #93 | Qwen3.8 27B medium | Qwen | 3.0 | 7.8 | ~$0.058 | 0/1 | 11.3s |
| #323 | Grok 4.20 none | X AI | 0.0 | 4.1 | $0.057 | 0/0 | 0ms |
| #132 | GLM 5.3 Flash high | Z.ai | 3.0 | 7.3 | $0.057 | 0/1 | 11.5s |
| #196 | GLM 5.3 FlashX medium | Z.ai | 3.0 | 6.4 | $0.056 | 0/1 | 2.60s |
| #241 | Inkling Small low | Thinkingmachines | 3.0 | 5.7 | $0.055 | 0/1 | 2.00s |
| #239 | Nemotron 3 Super medium | NVIDIA | 3.0 | 5.7 | $0.054 | 0/1 | 55.3s |
| #292 | DeepSeek V3.2 none | DeepSeek | 3.0 | 5.0 | $0.054 | 0/1 | 17.2s |
| #270 | Inkling Small none | Thinkingmachines | 3.0 | 5.3 | $0.054 | 0/1 | 481ms |
| #263 | Laguna S 2.1 medium | Poolside | 3.0 | 5.4 | $0.053 | 0/1 | 7.11s |
| #96 | Qwen3.7 Flash high | Qwen | 3.0 | 7.8 | $0.052 | 0/1 | 17.7s |
| #248 | GLM 5V Turbo none | Z.ai | 3.0 | 5.6 | $0.052 | 0/1 | 2.23s |
| #192 | Gemini 3.1 Flash Lite Preview none | 3.0 | 6.4 | $0.052 | 0/1 | 814ms | |
| #207 | GPT-5.6 Luna low | OpenAI | 3.0 | 6.2 | $0.051 | 0/1 | 4.86s |