Classement Spécifique au domaine
Voyez quels modèles d'IA réussissent le mieux sur Spécifique au domaine, lesquels restent fiables et où les écarts sont les plus marqués.
Modèles affichés
15
Moyenne de Score Spécifique au domaine
4.7
Meilleur modèle
Gemini 3 Flash Preview 10.0
206/206
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Spécifique au domaine | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #1 | Gemini 3 Flash Preview medium | 10.0 | 9.6 | $0.742 | 3/3 | 15.3s | |
| #87 | Gemini 3.5 Flash minimal | 10.0 | 6.8 | $0.300 | 3/3 | 899ms | |
| #7 | Gemini 3.1 Pro Preview medium | 7.7 | 9.2 | $1.361 | 2/3 | 32.7s | |
| #9 | Gemini 3.5 Flash medium | 7.7 | 9.1 | $0.642 | 2/3 | 5.24s | |
| #11 | Gemini 3.5 Flash low | 7.7 | 8.9 | $0.433 | 2/3 | 3.39s | |
| #15 | Claude Opus 4.7 medium | Anthropic | 7.7 | 8.7 | $1.477 | 2/3 | 1.17s |
| #23 | Claude Sonnet 5 medium | Anthropic | 7.7 | 8.3 | $0.922 | 2/3 | 20.4s |
| #28 | Inkling high | Thinkingmachines | 7.7 | 8.0 | $1.006 | 2/3 | 186.4s |
| #29 | Step 3.7 Flash medium | Stepfun | 7.7 | 8.0 | $0.515 | 2/3 | 48.3s |
| #44 | GPT-5.6 Luna high | OpenAI | 7.7 | 7.7 | $1.017 | 2/3 | 79.0s |
| #59 | Qwen3.7 Max none | Qwen | 7.7 | 7.4 | $0.197 | 2/3 | 975ms |
| #62 | Claude Sonnet 4.6 none | Anthropic | 7.7 | 7.3 | $0.661 | 2/3 | 3.54s |
| #88 | Gemini 3 Flash Preview none | 7.7 | 6.8 | $0.085 | 2/3 | 963ms | |
| #92 | Claude Opus 4.7 none | Anthropic | 7.7 | 6.6 | $0.505 | 2/3 | 1.19s |
| #95 | Qwen3.6 Max Preview none | Qwen | 7.7 | 6.6 | $0.231 | 2/3 | 1.22s |