Classement Spécifique au domaine
Voyez quels modèles d'IA réussissent le mieux sur Spécifique au domaine, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Tests corrects ↓.
Modèles affichés
15
Moyenne de Score Spécifique au domaine
4.7
Meilleur modèle
Gemini 3 Flash Preview 10.0
210/210
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Spécifique au domaine | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #162 | Ling-2.6-1T none | Inclusionai | 3.0 | 5.3 | $0.016 | 0/3 | 1.04s |
| #168 | MiMo-V2.5 none | Xiaomi | 3.0 | 5.1 | $0.025 | 0/3 | 756ms |
| #169 | Qwen3.5-9B none | Qwen | 3.0 | 5.1 | $0.021 | 0/3 | 464ms |
| #171 | North Mini Code none | Cohere | 3.0 | 5.1 | $0.000 | 0/3 | 14.7s |
| #172 | MiniMax M2.7 medium | Minimax | 3.0 | 5.0 | $0.163 | 0/3 | 19.0s |
| #173 | DeepSeek V3.2 none | DeepSeek | 2.9 | 5.0 | $0.054 | 0/3 | 4.17s |
| #174 | GPT-4o-mini none | OpenAI | 3.0 | 5.0 | $0.010 | 0/3 | 637ms |
| #175 | Qwen3.6 Plus Preview medium | Qwen | 3.0 | 4.9 | $0.000 | 0/3 | 22.1s |
| #177 | Nemotron 3 Super none | NVIDIA | 3.6 | 4.9 | $0.008 | 0/3 | 6.23s |
| #178 | Ling-2.6-flash none | Inclusionai | 3.0 | 4.9 | $0.002 | 0/3 | 4.95s |
| #180 | GPT-5.4 Nano none | OpenAI | 2.9 | 4.8 | $0.041 | 0/3 | 926ms |
| #181 | Grok 4.20 Multi Agent Beta medium | X AI | 2.9 | 4.8 | $5.599 | 0/3 | 24.7s |
| #182 | KAT-Coder-Air V2.5 none | Kwaipilot | 2.9 | 4.8 | $0.067 | 0/3 | 6.24s |
| #184 | Hunter Alpha medium | OpenRouter | 3.0 | 4.7 | $0.000 | 0/3 | 10.5s |
| #188 | Cobuddy medium | Baidu | 2.9 | 4.7 | $0.000 | 0/3 | 128.2s |