Classement Spécifique au domaine
Voyez quels modèles d'IA réussissent le mieux sur Spécifique au domaine, lesquels restent fiables et où les écarts sont les plus marqués.
Modèles affichés
15
Moyenne de Score Spécifique au domaine
4.7
Meilleur modèle
Gemini 3 Flash Preview 10.0
210/210
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Spécifique au domaine | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #37 | Qwen3.6 Plus medium | Qwen | 2.9 | 7.8 | $0.405 | 0/3 | 29.6s |
| #40 | Claude Sonnet 4.6 medium | Anthropic | 2.9 | 7.8 | $2.057 | 0/3 | 0ms |
| #60 | LongCat 2.0 medium | Meituan | 2.9 | 7.4 | $0.478 | 0/3 | 339.9s |
| #65 | Gemini 3.1 Flash Lite medium | 2.9 | 7.3 | $0.117 | 0/3 | 3.16s | |
| #70 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 2.9 | 7.2 | $0.317 | 0/3 | 53.1s |
| #72 | Qwen3.5-122B-A10B medium | Qwen | 2.9 | 7.1 | $1.046 | 0/3 | 63.4s |
| #78 | Mercury 2 medium | Inception | 2.9 | 7.0 | $0.093 | 0/3 | 6.48s |
| #81 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 2.9 | 6.9 | $0.467 | 0/3 | 29.0s |
| #87 | GPT-5.5 none | OpenAI | 2.9 | 6.9 | $0.544 | 0/3 | 1.31s |
| #99 | Qwen3.6 27B medium | Qwen | 2.9 | 6.5 | $0.779 | 0/3 | 73.4s |
| #102 | Laguna XS 2.1 medium | Poolside | 2.9 | 6.5 | $0.068 | 0/3 | 65.7s |
| #120 | Gemini 3.1 Flash Lite minimal | 2.9 | 6.1 | $0.047 | 0/3 | 1.02s | |
| #122 | Gemini 3.1 Flash Lite none | 2.9 | 6.1 | $0.046 | 0/3 | 762ms | |
| #144 | KAT-Coder-Air V2.5 high | Kwaipilot | 2.9 | 5.6 | $0.077 | 0/3 | 7.47s |
| #151 | GLM 5.1 none | Z.ai | 2.9 | 5.5 | $0.164 | 0/3 | 1.99s |