- Rang
- #119
- Total des jetons de sortie
- 714,287
- Temps de réponse (moy.)
- 300.15s
- Coût total
- $1.648
Mistral Large 4 (low) vs Qwen3.5 Plus 2026-04-20 (medium)
Qwen3.5 Plus 2026-04-20 (medium) mène au score moyen avec 7.7 vs 7.6. Qwen3.5 Plus 2026-04-20 (medium) a le coût de benchmark le plus bas avec $0.435 vs $1.648. Qwen3.5 Plus 2026-04-20 (medium) est plus rapide avec 54.06s vs 300.15s, avec des taux de réussite de 65.2% vs 65.2%.
Modèles comparés
- Rang
- #116
- Total des jetons de sortie
- 200,348
- Temps de réponse (moy.)
- 54.06s
- Coût total
- $0.435
Modèle recommandé
Qwen3.5 Plus 2026-04-20 (medium)
Il obtient le meilleur score ici (7.7) tout en coûtant environ 3.8x moins que Mistral Large 4 (low).
Comparaison détaillée
| Métrique | Mistral Large 4 Mistral Large 4 low | Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium |
|---|---|---|
| Score | 7.6 | 7.7 |
| Rang | #119 | #116 |
| Fiabilité | 9.0 | 9.7 |
| Cohérence | 8.7 | 9.1 |
| Tentatives | 69/69 | 69/69 |
| Tests corrects | ||
| Taux de réussite par tentative | 65.2% | 65.2% |
| Tests instables | 4 | 2 |
| Exécutions totales | 69 | 69 |
| Coût par résultat | 12.670 | 3.481 |
| Coût total | $1.648 | $0.435 |
| Prix d'entrée | $0.680 / 1M | $0.300 / 1M |
| Prix de sortie | $2.090 / 1M | $1.800 / 1M |
| Prix de lecture du cache | $0.070 / 1M | N/D |
| Prix d’écriture du cache | N/D | $0.375 / 1M |
| Total des jetons d'entrée | 226,734 | 176,539 |
| Jetons de sortie | 278,013 | 4,419 |
| Jetons de raisonnement | 638,296 | 195,929 |
| Temps de réponse (moy.) | 300.15s | 54.06s |
| Temps de réponse (max) | 1798.01s | 203.01s |
| Temps de réponse (total) | 6903.40s | 1189.36s |
| Paramètres | 1.05T au total (49B actifs) | ~397B au total (~17B actifs) |
| Disponibilité | Source fermée | Source fermée |
Les prix du cache concernent les tokens d’entrée. La lecture réutilise les prompts en cache ; l’écriture les stocke et peut coûter plus cher. Les tokens de sortie utilisent le prix de sortie.
Génération showcase de modèles
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#119 Mistral Large 4
low- Coût
- $0.015
- Temps
- 115.1s
- Tokens
- 6,915 tok
#116 Qwen3.5 Plus 2026-04-20
medium- Coût
- $0.008
- Temps
- 76.7s
- Tokens
- 4,355 tok
Meilleurs modèles par score
Score vs coût total
Temps de réponse (moy.)
Score vs Temps de réponse (moy.)
Total des jetons de sortie
Score vs Total des jetons de sortie
Répartition par catégorie
| Tâches agentiques | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 69.63s | 143,243 | 3,788 | 3,053 | |
| Qwen3.5 Plus 2026-04-20 | 10.0 | 10.0 | 100.0% | 0 | 203.01s | 134,433 | 2,139 | 26,086 |
| Astuces anti-IA | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 8.3 | 10.0 | 75.0% | 0 | 19.75s | 705 | 999 | 9,354 | |
| Qwen3.5 Plus 2026-04-20 | 10.0 | 10.0 | 100.0% | 0 | 10.84s | 672 | 215 | 7,748 |
| Programmation | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 3.4 | 7.2 | 22.2% | 1 | 1379.72s | 5,896 | 129,426 | 386,126 | |
| Qwen3.5 Plus 2026-04-20 | 6.2 | 8.7 | 33.3% | 0 | 125.25s | 7,630 | 308 | 58,682 |
| Combiné | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 556.27s | 60,360 | 5,603 | 60,531 | |
| Qwen3.5 Plus 2026-04-20 | 6.5 | 10.0 | 50.0% | 0 | 92.41s | 14,934 | 483 | 17,490 |
| Analyse et extraction des données | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 27.46s | 7,314 | 1,014 | 7,623 | |
| Qwen3.5 Plus 2026-04-20 | 10.0 | 10.0 | 100.0% | 0 | 38.32s | 7,782 | 270 | 14,668 |
| Spécifique au domaine | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 2.9 | 7.2 | 11.1% | 1 | 291.62s | 798 | 82,605 | 111,098 | |
| Qwen3.5 Plus 2026-04-20 | 2.9 | 7.2 | 11.1% | 1 | 57.36s | 780 | 63 | 31,644 |
| Intelligence générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 39.29s | 516 | 5,529 | 5,865 | |
| Qwen3.5 Plus 2026-04-20 | 4.9 | 9.6 | 0.0% | 0 | 25.30s | 516 | 125 | 4,792 |
| Suivi des instructions | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 8.4 | 6.9 | 83.3% | 1 | 23.21s | 708 | 5,408 | 6,402 | |
| Qwen3.5 Plus 2026-04-20 | 10.0 | 10.0 | 100.0% | 0 | 20.25s | 699 | 103 | 7,689 |
| Résolution d'énigmes | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 7.7 | 7.3 | 77.8% | 1 | 35.82s | 717 | 8,012 | 9,030 | |
| Qwen3.5 Plus 2026-04-20 | 8.2 | 7.2 | 88.9% | 1 | 17.67s | 696 | 338 | 9,800 |
| Appel d'outils | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 21.53s | 6,267 | 307 | 1,015 | |
| Qwen3.5 Plus 2026-04-20 | 10.0 | 10.0 | 100.0% | 0 | 14.72s | 8,193 | 348 | 2,164 |
| Culture générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 3.0 | 10.0 | 0.0% | 0 | 358.62s | 210 | 35,322 | 38,199 | |
| Qwen3.5 Plus 2026-04-20 | 3.0 | 10.0 | 0.0% | 0 | 92.57s | 204 | 27 | 15,166 |
Comparaison rapide
Changer la paire de comparaison
Muse Glimmer 30BhighvsQwen3.5 Plus 2026-04-20mediumGPT-6 LunahighvsQwen3.5 Plus 2026-04-20mediumMistral Large 4lowvsQwen3.8 Flash NextmediumMistral Large 4lowvsSpace Bunny AlphahighMistral Large 4lowvsGLM 5.1mediumQwen3.5 Plus 2026-04-20mediumvsGrok 4.5lowSeed-2.0-MinimediumvsMistral Large 4lowMuse Glimmer 30BmediumvsMistral Large 4lowMuse Glimmer 30BhighvsMistral Large 4lowMistral Large 4lowvsGPT-6 LunahighQwen3.5 Plus 2026-04-20mediumvsGLM 5.3highSeed-2.0-CodehighvsMistral Large 4low