Classement Culture générale
Voyez quels modèles d'IA réussissent le mieux sur Culture générale, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Coût total ↓.
Modèles affichés
15
Moyenne de Score Culture générale
3.3
Meilleur modèle
Grok 4.20 Multi Agent Beta 0.0
343/343
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Culture générale | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #54 | DeepSeek V4.1 Flash medium | DeepSeek | 3.0 | 8.5 | $0.272 | 0/1 | 20.3s |
| #89 | Gemini 3.5 Flash Lite medium | 2.8 | 7.8 | $0.272 | 0/1 | 3.75s | |
| #130 | GLM 5.3 high | Z.ai | 3.0 | 7.3 | $0.262 | 0/1 | 22.0s |
| #42 | Gemini 3.6 Flash low | 10.0 | 8.7 | $0.251 | 1/1 | 2.94s | |
| #245 | Qwen3.5-122B-A10B none | Qwen | 3.0 | 5.7 | $0.247 | 0/1 | 295ms |
| #72 | GPT-5 Mini medium | OpenAI | 3.0 | 8.1 | $0.241 | 0/1 | 9.99s |
| #119 | Gemini 3.8 Flash low | 10.0 | 7.5 | $0.239 | 1/1 | 2.29s | |
| #94 | Seed-2.0-Lite medium | Bytedance Seed | 3.0 | 7.8 | $0.236 | 0/1 | 48.3s |
| #244 | Kimi K2.6 none | Moonshot AI | 3.0 | 5.7 | $0.233 | 0/1 | 1.36s |
| #193 | Qwen3.6 Max Preview none | Qwen | 3.0 | 6.4 | $0.228 | 0/1 | 1.97s |
| #97 | GLM 5 medium | Z.ai | 3.0 | 7.7 | $0.228 | 0/1 | 67.4s |
| #142 | Muse Glimmer 30B medium | Meta | 3.0 | 7.2 | $0.227 | 0/1 | 26.7s |
| #52 | DeepSeek V4.1 Flash low | DeepSeek | 3.0 | 8.5 | $0.224 | 0/1 | 46.9s |
| #170 | MiMo-V2.5-Pro medium | Xiaomi | 3.0 | 6.8 | $0.221 | 0/1 | 12.5s |
| #135 | DeepSeek V4 Flash 0731 medium | DeepSeek | 3.0 | 7.3 | $0.216 | 0/1 | 56.6s |