Classement Combiné
Voyez quels modèles d'IA réussissent le mieux sur Combiné, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Coût total ↓.
Raisons d'échec
Avec la raison d'échec Appel d'outil invalide91 Avec la raison d'échec Mauvaise réponse68 Avec la raison d'échec Aucune réponse29 Avec la raison d'échec Erreur API26 Avec la raison d'échec Délai dépassé5 Avec la raison d'échec Mise en forme supplémentaire1 Avec la raison d'échec N'a pas suivi les instructions1
210/210
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Combiné | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #199 | Hy3 preview none | Tencent | 1.5 | 4.0 | $0.003 | 0/1 | 35.8s |
| #178 | Ling-2.6-flash none | Inclusionai | 3.0 | 4.9 | $0.002 | 0/2 | 35.7s |
| #210 | LFM2-24B-A2B none | Liquid | 1.5 | 2.2 | $0.001 | 0/1 | 0ms |
| #137 | North Mini Code medium | Cohere | 2.9 | 5.9 | $0.000 | 0/2 | 554.9s |
| #146 | Owl Alpha medium | Openrouter | 1.5 | 5.6 | $0.000 | 0/1 | 10.0s |
| #148 | Owl Alpha none | Openrouter | 1.5 | 5.6 | $0.000 | 0/1 | 21.7s |
| #171 | North Mini Code none | Cohere | 3.2 | 5.1 | $0.000 | 0/2 | 96.2s |
| #175 | Qwen3.6 Plus Preview medium | Qwen | 5.0 | 4.9 | $0.000 | 1/1 | 35.0s |
| #184 | Hunter Alpha medium | OpenRouter | 2.3 | 4.7 | $0.000 | 0/1 | 30.5s |
| #188 | Cobuddy medium | Baidu | 1.5 | 4.7 | $0.000 | 0/1 | 47.4s |
| #193 | Elephant Alpha none | Openrouter | 1.5 | 4.3 | $0.000 | 0/1 | 3.81s |
| #195 | Elephant Alpha medium | Openrouter | 1.5 | 4.3 | $0.000 | 0/1 | 3.70s |
| #196 | Hunter Alpha none | OpenRouter | 1.5 | 4.2 | $0.000 | 0/1 | 15.2s |
| #207 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 1.5 | 3.4 | $0.000 | 0/1 | 0ms |
| #208 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 1.5 | 3.2 | $0.000 | 0/1 | 0ms |