Classement Culture générale
Voyez quels modèles d'IA réussissent le mieux sur Culture générale, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Temps de réponse (moy.) ↑.
250/250
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Culture générale | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #129 | Gemini 3.1 Flash Lite Preview none | 3.0 | 6.4 | $0.052 | 0/1 | 814ms | |
| #77 | Qwen3.7 Max none | Qwen | 3.0 | 7.4 | $0.197 | 0/1 | 856ms |
| #237 | Ling 3.0 Tiny none | Inclusionai | 3.0 | 4.0 | $0.000 | 0/1 | 988ms |
| #166 | GPT-5.4 none | OpenAI | 3.0 | 5.8 | $0.397 | 0/1 | 990ms |
| #212 | Ling-2.6-flash none | Inclusionai | 3.0 | 4.9 | $0.002 | 0/1 | 1.06s |
| #110 | Gemini 3 Flash Preview none | 3.0 | 6.8 | $0.085 | 0/1 | 1.07s | |
| #130 | Qwen3.5 Plus 2026-02-15 none | Qwen | 3.0 | 6.4 | $0.073 | 0/1 | 1.11s |
| #142 | Gemini 2.5 Flash none | 3.0 | 6.2 | $0.017 | 0/1 | 1.15s | |
| #91 | Qwen3.7 Plus none | Qwen | 3.0 | 7.2 | $0.106 | 0/1 | 1.21s |
| #139 | Gemma 4 31B none | 3.0 | 6.2 | $0.018 | 0/1 | 1.25s | |
| #186 | Mimo V2 Omni none | Xiaomi | 3.0 | 5.5 | $0.021 | 0/1 | 1.30s |
| #163 | GPT-5.4 Mini none | OpenAI | 3.0 | 5.9 | $0.095 | 0/1 | 1.33s |
| #127 | Gemini 3.1 Flash Lite Preview low | 3.0 | 6.5 | $0.646 | 0/1 | 1.35s | |
| #165 | Kimi K2.6 none | Moonshot AI | 3.0 | 5.8 | $0.142 | 0/1 | 1.36s |
| #115 | Claude Opus 4.7 none | Anthropic | 3.0 | 6.6 | $0.505 | 0/1 | 1.46s |