Classement Spécifique au domaine
Voyez quels modèles d'IA réussissent le mieux sur Spécifique au domaine, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Temps de réponse (moy.) ↑.
Modèles affichés
15
Moyenne de Score Spécifique au domaine
4.7
Meilleur modèle
Claude Sonnet 4.6 2.9
220/220
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Spécifique au domaine | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #14 | Gemini 3.5 Flash low | 7.7 | 8.9 | $0.433 | 2/3 | 3.39s | |
| #67 | Claude Sonnet 4.6 none | Anthropic | 7.7 | 7.3 | $0.661 | 2/3 | 3.54s |
| #95 | Gemini 3.5 Flash-Lite low | 3.6 | 6.7 | $0.145 | 0/3 | 3.63s | |
| #86 | DeepSeek V4 Pro none | DeepSeek | 5.3 | 6.9 | $0.096 | 1/3 | 3.72s |
| #6 | Gemini 3.6 Flash low | 10.0 | 9.4 | $0.517 | 3/3 | 3.96s | |
| #101 | GLM 5.2 none | Z.ai | 5.3 | 6.6 | $0.124 | 1/3 | 4.04s |
| #182 | DeepSeek V3.2 none | DeepSeek | 2.9 | 5.0 | $0.054 | 0/3 | 4.17s |
| #68 | Gemini 3.1 Flash Lite Preview medium | 3.0 | 7.3 | $0.115 | 0/3 | 4.21s | |
| #161 | Kimi K2.5 none | Moonshot AI | 5.3 | 5.5 | $0.127 | 1/3 | 4.38s |
| #132 | Qwen3.5 Plus 2026-04-20 none | Qwen | 5.3 | 6.1 | $0.122 | 1/3 | 4.43s |
| #155 | KAT-Coder-Air V2.5 medium | Kwaipilot | 3.0 | 5.6 | $0.048 | 0/3 | 4.87s |
| #187 | Ling-2.6-flash none | Inclusionai | 3.0 | 4.9 | $0.002 | 0/3 | 4.95s |
| #165 | KAT-Coder-Air V2.5 low | Kwaipilot | 2.9 | 5.4 | $0.041 | 0/3 | 4.99s |
| #12 | Gemini 3.5 Flash medium | 7.7 | 9.1 | $0.642 | 2/3 | 5.24s | |
| #202 | Laguna M.1 none | Poolside | 3.6 | 4.4 | $0.009 | 0/3 | 5.50s |