General Intelligence Ranking
See which AI models perform best on General Intelligence, which ones stay reliable, and where the biggest gaps appear. Sort by: Response Time (avg) ↓.
319/319
Filter models
No models match the current search and filters.
| Rank | Model | Company | General Intelligence Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #39 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.983 | 1/1 | 2.46s |
| #216 | Seed 2.1 Turbo none | Bytedance Seed | 5.0 | 5.9 | $0.092 | 0/1 | 2.44s |
| #232 | Mimo V2 PRO none | Xiaomi | 4.3 | 5.6 | $0.045 | 0/1 | 2.44s |
| #82 | GPT-5.6 Terra medium | OpenAI | 5.5 | 7.8 | $0.523 | 0/1 | 2.37s |
| #143 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 4.7 | 6.9 | $0.478 | 0/1 | 2.35s |
| #165 | Gemini 3.5 Flash Lite low | 10.0 | 6.6 | $0.138 | 1/1 | 2.34s | |
| #240 | Mimo V2 Omni none | Xiaomi | 4.1 | 5.5 | $0.021 | 0/1 | 2.33s |
| #118 | KAT-Coder-Pro V2.5 low | Kwaipilot | 4.1 | 7.3 | $0.400 | 0/1 | 2.32s |
| #35 | Gemini 3.5 Flash low | 10.0 | 8.8 | $0.449 | 1/1 | 2.27s | |
| #172 | Qwen3.5 Plus 2026-02-15 none | Qwen | 4.4 | 6.6 | $0.073 | 0/1 | 2.26s |
| #188 | GPT-5.6 Luna low | OpenAI | 5.0 | 6.2 | $0.051 | 0/1 | 2.25s |
| #229 | GLM 5V Turbo none | Z.ai | 4.6 | 5.6 | $0.052 | 0/1 | 2.22s |
| #265 | GLM 5 Turbo none | Z.ai | 4.2 | 5.1 | $0.047 | 0/1 | 2.18s |
| #104 | Mercury 2.5 Preview medium | Inception | 5.0 | 7.5 | $0.024 | 0/1 | 2.09s |
| #199 | Gemma 4 31B none | 10.0 | 6.1 | $0.016 | 1/1 | 2.09s |