Trivia Ranking
See which AI models perform best on Trivia, which ones stay reliable, and where the biggest gaps appear. Sort by: Response Time (avg) ↑.
343/343
Filter models
No models match the current search and filters.
| Rank | Model | Company | Trivia Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #333 | Ling 3.0 Tiny low | Inclusionai | 3.0 | 3.8 | $0.000 | 0/1 | 213.5s |
| #231 | Mimo V2 Omni medium | Xiaomi | 3.0 | 5.9 | $0.683 | 0/1 | 234.2s |
| #77 | DeepSeek V4 Flash 0731 low | DeepSeek | 3.0 | 8.0 | $0.138 | 0/1 | 246.9s |
| #312 | Granite 4.2 8B high | IBM Granite | 3.0 | 4.6 | $0.135 | 0/1 | 252.5s |
| #60 | Qwen3.8 27B high | Qwen | 3.0 | 8.4 | ~$0.287 | 0/1 | 264.0s |
| #238 | North Mini Code medium | Cohere | 3.0 | 5.7 | $0.000 | 0/1 | 305.0s |
| #122 | Kimi K2.7 Code medium | Moonshot AI | 3.0 | 7.4 | $0.655 | 0/1 | 341.8s |
| #125 | Qwen3.8 2.4T A95B high | Qwen | 3.0 | 7.4 | $2.357 | 0/1 | 348.0s |
| #126 | MiMo-V2.6-Flash medium | Xiaomi | 3.0 | 7.4 | $0.190 | 0/1 | 357.3s |
| #71 | Qwen3.8 2.4T A95B low | Qwen | 3.0 | 8.1 | $2.672 | 0/1 | 422.5s |
| #61 | MiMo-V2.6-Pro medium | Xiaomi | 2.8 | 8.4 | $0.477 | 0/1 | 527.1s |
| #31 | Qwen3.8 Max (0902) high | Qwen | 3.0 | 8.9 | $2.736 | 0/1 | 532.6s |
| #255 | Hy4 preview low | Tencent | 3.0 | 5.6 | $1.745 | 0/1 | 597.4s |