Classement Intelligence générale
Voyez quels modèles d'IA réussissent le mieux sur Intelligence générale, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Coût total ↓.
Modèles affichés
15
Moyenne de Score Intelligence générale
6.3
Meilleur modèle
Grok 4.20 Multi Agent Beta 5.8
316/316
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Intelligence générale | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #251 | Qwen3.6 35B A3B none | Qwen | 4.4 | 5.3 | $0.051 | 0/1 | 3.51s |
| #92 | Solar Pro 4 xhigh | Upstage | 5.5 | 7.6 | $0.050 | 0/1 | 61.9s |
| #217 | Nemotron 3 Super medium | NVIDIA | 4.1 | 5.7 | $0.050 | 0/1 | 6.91s |
| #172 | Hy3 preview medium | Tencent | 10.0 | 6.5 | $0.049 | 1/1 | 16.8s |
| #231 | KAT-Coder-Air V2.5 medium | Kwaipilot | 5.0 | 5.6 | $0.048 | 0/1 | 9.81s |
| #149 | Solar Pro 4 medium | Upstage | 3.0 | 6.8 | $0.047 | 0/1 | 48.0s |
| #187 | Gemini 3.1 Flash Lite minimal | 4.0 | 6.1 | $0.047 | 0/1 | 791ms | |
| #262 | GLM 5 Turbo none | Z.ai | 4.2 | 5.1 | $0.047 | 0/1 | 2.18s |
| #130 | Solar Pro 4 high | Upstage | 5.5 | 7.1 | $0.046 | 0/1 | 42.2s |
| #191 | Gemini 3.1 Flash Lite none | 4.0 | 6.1 | $0.046 | 0/1 | 992ms | |
| #240 | KAT-Coder-Air V2.5 low | Kwaipilot | 5.0 | 5.4 | $0.046 | 0/1 | 10.1s |
| #229 | Mimo V2 PRO none | Xiaomi | 4.3 | 5.6 | $0.045 | 0/1 | 2.44s |
| #177 | LongCat 2.0 none | Meituan | 5.0 | 6.4 | $0.044 | 0/1 | 2.76s |
| #66 | DeepSeek V4 Flash 0731 low | DeepSeek | 6.5 | 8.0 | $0.044 | 0/1 | 7.63s |
| #148 | Solar Pro 4 low | Upstage | 5.5 | 6.8 | $0.044 | 0/1 | 61.2s |