Trivia Ranking
See which AI models perform best on Trivia, which ones stay reliable, and where the biggest gaps appear. Sort by: Response Time (avg) ↑.
343/343
Filter models
No models match the current search and filters.
| Rank | Model | Company | Trivia Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #80 | Inkling medium | Thinkingmachines | 2.8 | 8.0 | $0.383 | 0/1 | 21.7s |
| #247 | KAT-Coder-Air V2.5 high | Kwaipilot | 3.0 | 5.6 | $0.077 | 0/1 | 21.7s |
| #130 | GLM 5.3 high | Z.ai | 3.0 | 7.3 | $0.262 | 0/1 | 22.0s |
| #64 | GLM 5.3 FlashX max | Z.ai | 3.0 | 8.3 | $0.508 | 0/1 | 22.4s |
| #289 | MiniMax M2.7 medium | Minimax | 3.0 | 5.0 | $0.208 | 0/1 | 22.8s |
| #76 | Muse Spark 1.1 high | Meta | 3.0 | 8.0 | $2.253 | 0/1 | 22.9s |
| #81 | GPT-5.6 Terra high | OpenAI | 3.0 | 8.0 | $0.836 | 0/1 | 23.3s |
| #69 | Muse Spark 1.3 low | Meta | 3.0 | 8.2 | $0.689 | 0/1 | 23.4s |
| #67 | Claude Fable 5.1 medium | Anthropic | 2.8 | 8.3 | $2.909 | 0/1 | 24.3s |
| #199 | Ling-3.0-flash high | Inclusionai | 3.0 | 6.4 | $0.021 | 0/1 | 24.3s |
| #308 | Grok 4.1 Fast medium | X AI | 3.0 | 4.7 | $0.069 | 0/1 | 25.5s |
| #48 | Claude Fable 5 medium | Anthropic | 3.0 | 8.6 | $3.004 | 0/1 | 25.6s |
| #127 | Grok 4.6 low | X AI | 3.0 | 7.4 | $0.449 | 0/1 | 26.1s |
| #211 | gpt-oss-120b medium | OpenAI | 3.0 | 6.1 | $0.070 | 0/1 | 26.5s |
| #142 | Muse Glimmer 30B medium | Meta | 3.0 | 7.2 | $0.227 | 0/1 | 26.7s |