Classement Spécifique au domaine
Voyez quels modèles d'IA réussissent le mieux sur Spécifique au domaine, lesquels restent fiables et où les écarts sont les plus marqués.
Modèles affichés
15
Moyenne de Score Spécifique au domaine
4.7
Meilleur modèle
Gemini 3.6 Flash 10.0
216/216
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Spécifique au domaine | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #60 | GPT-5.4 Mini medium | OpenAI | 4.1 | 7.5 | $0.756 | 0/3 | 65.3s |
| #66 | KAT-Coder-Pro V2.5 low | Kwaipilot | 4.1 | 7.4 | $0.387 | 0/3 | 17.5s |
| #90 | Step 3.7 Flash high | Stepfun | 4.1 | 6.9 | $1.207 | 0/3 | 149.6s |
| #125 | Qwen3.5-35B-A3B medium | Qwen | 4.1 | 6.2 | $0.837 | 0/3 | 88.3s |
| #204 | Laguna Xs.2 medium | Poolside | 4.1 | 4.1 | $0.015 | 0/3 | 11.1s |
| #35 | GLM 5.2 high | Z.ai | 3.7 | 8.0 | $0.817 | 0/3 | 74.0s |
| #15 | Grok 4.5 high | X AI | 3.6 | 8.9 | $1.707 | 0/3 | 332.1s |
| #29 | GPT-5 Mini medium | OpenAI | 3.6 | 8.1 | $0.237 | 0/3 | 44.6s |
| #40 | Qwen3.7 Plus medium | Qwen | 3.6 | 7.9 | $0.267 | 0/3 | 45.3s |
| #50 | DeepSeek V4 Pro high | DeepSeek | 3.6 | 7.7 | $0.200 | 0/3 | 151.5s |
| #87 | GPT-5.6 Sol none | OpenAI | 3.6 | 6.9 | $0.524 | 0/3 | 1.43s |
| #95 | Gemini 3.5 Flash-Lite low | 3.6 | 6.7 | $0.145 | 0/3 | 3.63s | |
| #97 | KAT-Coder-Pro V2.5 none | Kwaipilot | 3.6 | 6.7 | $0.476 | 0/3 | 21.6s |
| #102 | LongCat 2.0 high | Meituan | 3.6 | 6.6 | $0.469 | 0/3 | 400.3s |
| #122 | Seed-2.0-Lite none | Bytedance Seed | 3.6 | 6.2 | $0.066 | 0/3 | 1.33s |