Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Modèles comparés

Comparaison benchmark Qwen3.8 27B (high) vs Qwen3.8 27B (medium) vs Qwen3.8 27B (low) vs Qwen3.8 27B: Qwen3.8 27B (high) mène sur Score avec 8.4. Qwen3.8 27B (low) mène sur Fiabilité avec 10.0. Qwen3.8 27B a le Coût total le plus bas à ~$0.006. Qwen3.8 27B est le plus rapide à 3.12s.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-08-15

Rang
#42
Total des jetons de sortie
656,635
Temps de réponse (moy.)
167.89s
Coût total
~$0.287
Rang
#68
Total des jetons de sortie
136,162
Temps de réponse (moy.)
33.05s
Coût total
~$0.058
Rang
#61
Total des jetons de sortie
169,329
Temps de réponse (moy.)
39.11s
Coût total
~$0.071
Rang
#214
Total des jetons de sortie
11,445
Temps de réponse (moy.)
3.12s
Coût total
~$0.006
Modèle recommandé Qwen3.8 27B

Il offre le meilleur compromis global: score compétitif (5.5), coût inférieur à les autres modèles de cette comparaison et temps de réponse équilibré.

Comparaison détaillée

Métrique Qwen3.8 27B Qwen3.8 27B high Sortie: 2026-08-14 Qwen3.8 27B Qwen3.8 27B medium Sortie: 2026-08-14 Qwen3.8 27B Qwen3.8 27B low Sortie: 2026-08-14 Qwen3.8 27B Qwen3.8 27B none Sortie: 2026-08-14
Score 8.4 7.8 7.9 5.5
Rang #42 #68 #61 #214
Fiabilité 9.6 9.6 10.0 10.0
Cohérence 9.2 9.7 10.0 10.0
Tentatives 66/66 66/66 66/66 66/66
Tests corrects
Taux de réussite par tentative 77.3% 66.7% 68.2% 40.9%
Tests instables 2 1 0 0
Exécutions totales 66 66 66 66
Coût par résultat ~1.792 ~0.409 ~0.473 ~0.063
Coût total ~$0.287 ~$0.058 ~$0.071 ~$0.006
Prix d'entrée N/D N/D N/D N/D
Prix de sortie N/D N/D N/D N/D
Total des jetons d'entrée 100,179 98,266 99,705 122,463
Jetons de sortie 904 1,861 1,545 11,445
Jetons de raisonnement 655,731 134,301 167,784 0
Temps de réponse (moy.) 167.89s 33.05s 39.11s 3.12s
Temps de réponse (max) 640.85s 214.63s 376.04s 44.76s
Temps de réponse (total) 3693.54s 694.04s 860.51s 68.69s
Paramètres 27.3B 27.3B 27.3B 27.3B
Disponibilité Poids disponibles Poids disponibles Poids disponibles Poids disponibles

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Qwen3.8 27B

high
Coût
~$0.008
Temps
270.1s
Tokens
18,963 tok

#68 Qwen3.8 27B

medium
Coût
~$0.002
Temps
43.4s
Tokens
2,956 tok

#61 Qwen3.8 27B

low
Coût
~$0.003
Temps
92.8s
Tokens
6,902 tok

#214 Qwen3.8 27B

none
Coût
~$0.001
Temps
23.9s
Tokens
1,922 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0

Comparaison rapide

Changer la paire de comparaison

GPT-5.2mediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5lowQwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowClaude Opus 4.8lowvsQwen3.8 27BmediumKimi K3maxvsQwen3.8 27BlowNemotron 3.5 LightninghighDisponible gratuitementvsQwen3.8 27BnoneKAT-Coder-Air V2.5mediumvsQwen3.8 27BnoneQwen3.8 27BhighvsGrok 4.6mediumGPT-5.6 TerrahighvsQwen3.8 27BlowSeed-2.0-CodelowvsQwen3.8 27Bmedium