Classement Culture générale
Voyez quels modèles d'IA réussissent le mieux sur Culture générale, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Temps de réponse (moy.) ↓.
250/250
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Culture générale | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #104 | GPT-5.6 Sol none | OpenAI | 3.0 | 6.9 | $0.524 | 0/1 | 1.95s |
| #183 | MiMo-V2.5-Pro none | Xiaomi | 3.0 | 5.5 | $0.068 | 0/1 | 1.89s |
| #16 | Gemini 3.5 Flash low | 10.0 | 8.9 | $0.433 | 1/1 | 1.88s | |
| #190 | DeepSeek V4 Flash 0731 none | DeepSeek | 3.0 | 5.4 | $0.014 | 0/1 | 1.85s |
| #154 | Nemotron 3 Ultra none | NVIDIA | 3.0 | 6.1 | $0.095 | 0/1 | 1.83s |
| #236 | MiMo-V2-Flash none | Xiaomi | 3.0 | 4.0 | $0.025 | 0/1 | 1.82s |
| #109 | Gemini 3.5 Flash minimal | 3.0 | 6.8 | $0.300 | 0/1 | 1.76s | |
| #126 | Gemini 3.5 Flash Lite low | 4.7 | 6.5 | $0.135 | 0/1 | 1.65s | |
| #176 | Mimo V2 PRO none | Xiaomi | 3.0 | 5.6 | $0.045 | 0/1 | 1.63s |
| #128 | Gemini 3.1 Flash Lite low | 3.0 | 6.5 | $0.621 | 0/1 | 1.46s | |
| #115 | Claude Opus 4.7 none | Anthropic | 3.0 | 6.6 | $0.505 | 0/1 | 1.46s |
| #165 | Kimi K2.6 none | Moonshot AI | 3.0 | 5.8 | $0.142 | 0/1 | 1.36s |
| #127 | Gemini 3.1 Flash Lite Preview low | 3.0 | 6.5 | $0.646 | 0/1 | 1.35s | |
| #163 | GPT-5.4 Mini none | OpenAI | 3.0 | 5.9 | $0.095 | 0/1 | 1.33s |
| #186 | Mimo V2 Omni none | Xiaomi | 3.0 | 5.5 | $0.021 | 0/1 | 1.30s |