Classement Culture générale
Voyez quels modèles d'IA réussissent le mieux sur Culture générale, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Coût total ↑.
250/250
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Culture générale | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #102 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 3.0 | 6.9 | $0.467 | 0/1 | 9.87s |
| #119 | LongCat 2.0 high | Meituan | 3.0 | 6.6 | $0.469 | 0/1 | 99.4s |
| #113 | KAT-Coder-Pro V2.5 none | Kwaipilot | 3.0 | 6.7 | $0.476 | 0/1 | 9.91s |
| #78 | LongCat 2.0 medium | Meituan | 3.0 | 7.4 | $0.478 | 0/1 | 191.2s |
| #89 | KAT-Coder-Pro V2.5 high | Kwaipilot | 3.0 | 7.2 | $0.482 | 0/1 | 5.22s |
| #22 | Gemini 3.6 Flash low | 10.0 | 8.7 | $0.501 | 1/1 | 2.94s | |
| #115 | Claude Opus 4.7 none | Anthropic | 3.0 | 6.6 | $0.505 | 0/1 | 1.46s |
| #43 | Step 3.7 Flash medium | Stepfun | 3.0 | 8.0 | $0.515 | 0/1 | 114.0s |
| #104 | GPT-5.6 Sol none | OpenAI | 3.0 | 6.9 | $0.524 | 0/1 | 1.95s |
| #94 | GLM 5.1 medium | Z.ai | 3.0 | 7.1 | $0.527 | 0/1 | 29.4s |
| #21 | Gemini 3.5 Flash Lite high | 3.0 | 8.8 | $0.538 | 0/1 | 9.68s | |
| #108 | GPT-5.5 none | OpenAI | 3.0 | 6.9 | $0.544 | 0/1 | 5.01s |
| #239 | Grok Build 0.1 none | X AI | 3.0 | 4.0 | $0.547 | 0/1 | 36.1s |
| #136 | Claude Sonnet 5 none | Anthropic | 3.0 | 6.3 | $0.548 | 0/1 | 4.31s |
| #72 | GPT-5.3 Chat none | OpenAI | 3.0 | 7.5 | $0.571 | 0/1 | 4.38s |