General Intelligence Ranking
See which AI models perform best on General Intelligence, which ones stay reliable, and where the biggest gaps appear. Sort by: Tests Correct ↓.
319/319
Filter models
No models match the current search and filters.
| Rank | Model | Company | General Intelligence Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #36 | Qwen3.8 Max (0902) medium | Qwen | 10.0 | 8.8 | $0.677 | 1/1 | 7.56s |
| #37 | Muse Spark 1.3 medium | Meta | 10.0 | 8.8 | $1.469 | 1/1 | 7.95s |
| #38 | Gemini 3.5 Flash Lite high | 10.0 | 8.8 | $0.540 | 1/1 | 3.10s | |
| #39 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.983 | 1/1 | 2.46s |
| #40 | Claude Opus 5 low | Anthropic | 10.0 | 8.7 | $1.121 | 1/1 | 3.76s |
| #41 | Gemini 3.6 Flash low | 10.0 | 8.7 | $0.251 | 1/1 | 3.02s | |
| #42 | GLM 5.3 Flash max | Z.ai | 10.0 | 8.7 | $0.059 | 1/1 | 10.0s |
| #43 | Claude Opus 4.7 medium | Anthropic | 10.0 | 8.7 | $1.476 | 1/1 | 2.87s |
| #44 | Muse Spark 1.2 high | Meta | 10.0 | 8.7 | $1.771 | 1/1 | 13.9s |
| #46 | Muse Spark 1.1 medium | Meta | 10.0 | 8.6 | $1.420 | 1/1 | 4.41s |
| #47 | Claude Fable 5 medium | Anthropic | 10.0 | 8.6 | $3.004 | 1/1 | 7.42s |
| #48 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.6 | $1.132 | 1/1 | 32.2s |
| #59 | Muse Spark 1.1 low | Meta | 10.0 | 8.3 | $0.673 | 1/1 | 4.12s |
| #60 | Claude Fable 5.1 medium | Anthropic | 10.0 | 8.3 | $2.909 | 1/1 | 5.14s |
| #62 | Muse Spark 1.3 low | Meta | 10.0 | 8.2 | $0.689 | 1/1 | 4.02s |