Classement Culture générale
Voyez quels modèles d'IA réussissent le mieux sur Culture générale, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Coût total ↓.
Modèles affichés
15
Moyenne de Score Culture générale
3.2
Meilleur modèle
Grok 4.20 Multi Agent Beta 0.0
250/250
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Culture générale | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #171 | Qwen3.5-122B-A10B none | Qwen | 3.0 | 5.7 | $0.283 | 0/1 | 295ms |
| #53 | Gemini 3.5 Flash Lite medium | 2.8 | 7.8 | $0.273 | 0/1 | 3.75s | |
| #55 | GPT-5.6 Terra medium | OpenAI | 3.0 | 7.8 | $0.271 | 0/1 | 10.1s |
| #51 | Qwen3.7 Plus medium | Qwen | 3.0 | 7.9 | $0.267 | 0/1 | 91.1s |
| #40 | GPT-5 Mini medium | OpenAI | 3.0 | 8.1 | $0.237 | 0/1 | 9.99s |
| #50 | Seed-2.0-Lite medium | Bytedance Seed | 3.0 | 7.9 | $0.234 | 0/1 | 48.3s |
| #120 | Qwen3.6 Max Preview none | Qwen | 3.0 | 6.6 | $0.228 | 0/1 | 1.97s |
| #73 | GPT-5.6 Terra low | OpenAI | 3.0 | 7.5 | $0.208 | 0/1 | 5.95s |
| #63 | DeepSeek V4 Pro high | DeepSeek | 3.0 | 7.7 | $0.200 | 0/1 | 34.0s |
| #77 | Qwen3.7 Max none | Qwen | 3.0 | 7.4 | $0.197 | 0/1 | 856ms |
| #105 | MiMo-V2.5-Pro medium | Xiaomi | 3.0 | 6.9 | $0.187 | 0/1 | 12.5s |
| #148 | Inkling low | Thinkingmachines | 3.0 | 6.1 | $0.187 | 0/1 | 3.12s |
| #79 | Gemini 3 Flash Preview low | 10.0 | 7.4 | $0.177 | 1/1 | 2.75s | |
| #205 | MiniMax M2.7 medium | Minimax | 3.0 | 5.0 | $0.176 | 0/1 | 22.8s |
| #230 | GLM 4.7 Flash medium | Z.ai | 3.0 | 4.3 | $0.166 | 0/1 | 11.1s |