Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.4 Mini vs Qwen: Qwen3.5-35B-A3B

Résumé

Comparaison benchmark GPT-5.4 Mini vs Qwen3.5-35B-A3B : Qwen3.5-35B-A3B mène au score moyen avec 5.9 vs 5.3. Qwen3.5-35B-A3B a le coût de benchmark le plus bas avec $0.012 vs $0.038. GPT-5.4 Mini est plus rapide avec 1.13s vs 3.37s, avec des taux de réussite de 30.2% vs 42.9%.

Modèle recommandé: Qwen3.5-35B-A3B - Il obtient le meilleur score ici (5.9) tout en coûtant environ 3.3x moins que GPT-5.4 Mini.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-12

Métrique GPT-5.4 Mini GPT-5.4 Mini none Sortie: 2026-03-17 Qwen3.5-35B-A3B Qwen3.5-35B-A3B none Sortie: 2026-02-24
Score 5.3 5.9
Rang #131 #108
Fiabilité 10.0 10.0
Cohérence 8.8 8.9
Tests corrects
Taux de réussite par tentative 30.2% 42.9%
Tests instables 3 3
Exécutions totales 63 63
Coût par résultat 0.743 0.230
Coût total $0.038 $0.012
Prix d'entrée $0.750 / 1M $0.140 / 1M
Prix de sortie $4.500 / 1M $1.000 / 1M
Total des jetons d'entrée 34,244 48,194
Jetons de sortie 2,541 4,343
Jetons de raisonnement 0 0
Temps de réponse (moy.) 1.13s 3.37s
Temps de réponse (max) 2.52s 47.43s
Temps de réponse (total) 23.82s 70.75s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#131 GPT-5.4 Mini

none
Cost
$0.010
Time
11.7s
Tokens
2,151 tok

#108 Qwen3.5-35B-A3B

none
Cost
$0.005
Time
28.4s
Tokens
4,518 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5.4 Mini 3.1 8.1 8.3% 1 929ms 606 654 0
Qwen3.5-35B-A3B 3.4 7.9 16.7% 1 1.43s 696 574 0
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0
Qwen3.5-35B-A3B 5.5 10.0 33.3% 0 1.39s 7,808 571 0
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5.4 Mini 3.0 10.0 0.0% 0 2.52s 11,019 298 0
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 47.43s 20,739 1,833 0
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5.4 Mini 10.0 10.0 100.0% 0 1.30s 7,140 222 0
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 1.16s 7,794 243 0
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5.4 Mini 3.5 4.4 33.3% 2 937ms 723 88 0
Qwen3.5-35B-A3B 7.7 10.0 66.7% 0 485ms 789 15 0
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5.4 Mini 4.8 10.0 0.0% 0 1.82s 477 174 0
Qwen3.5-35B-A3B 6.5 3.4 66.7% 1 1.19s 522 114 0
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5.4 Mini 6.3 10.0 50.0% 0 728ms 660 101 0
Qwen3.5-35B-A3B 6.3 10.0 50.0% 0 809ms 711 63 0
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5.4 Mini 5.4 10.0 33.3% 0 836ms 642 305 0
Qwen3.5-35B-A3B 3.7 7.4 22.2% 1 1.35s 714 655 0
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5.4 Mini 3.0 10.0 0.0% 0 2.32s 5,477 255 0
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 2.30s 8,211 264 0
Culture générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5.4 Mini 3.0 10.0 0.0% 0 1.33s 195 43 0
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 493ms 210 11 0

Comparaison rapide

Changer la paire de comparaison