Navigation
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.5 Plus 2026-02-15 vs StepFun: Step 3.7 Flash

Résumé

Comparaison benchmark Qwen3.5 Plus 2026-02-15 vs Step 3.7 Flash : Qwen3.5 Plus 2026-02-15 mène au score moyen avec 8.0 vs 7.1. Qwen3.5 Plus 2026-02-15 a le coût de benchmark le plus bas avec $0.310 vs $1.148. Step 3.7 Flash est plus rapide avec 64.46s vs 73.79s, avec des taux de réussite de 73.0% vs 63.5%.

Modèle recommandé: Qwen3.5 Plus 2026-02-15 - Il obtient le meilleur score ici (8.0) tout en coûtant environ 3.7x moins que Step 3.7 Flash.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-18

Métrique Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Sortie: 2026-02-15 Step 3.7 Flash Step 3.7 Flash high Sortie: 2026-05-29
Score 8.0 7.1
Rang #28 #63
Fiabilité 10.0 10.0
Cohérence 8.8 8.2
Tests corrects
Taux de réussite par tentative 73.0% 63.5%
Tests instables 3 4
Exécutions totales 63 63
Coût par résultat 2.445 10.434
Coût total $0.310 $1.148
Prix d'entrée $0.260 / 1M $0.200 / 1M
Prix de sortie $1.560 / 1M $1.150 / 1M
Total des jetons d'entrée 40,918 38,391
Jetons de sortie 2,159 991,355
Jetons de raisonnement 189,604 0
Temps de réponse (moy.) 73.79s 64.46s
Temps de réponse (max) 266.69s 364.99s
Temps de réponse (total) 1033.07s 1353.57s

Génération showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#28 Qwen3.5 Plus 2026-02-15

medium
Coût
$0.011
Temps
125.5s
Tokens
7,040 tok

#63 Step 3.7 Flash

high
Coût
$0.007
Temps
63.6s
Tokens
6,030 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 8.2 7.9 83.3% 1 45.78s 672 205 21,236
Step 3.7 Flash 10.0 10.0 100.0% 0 13.40s 696 42,656 0
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595
Step 3.7 Flash 4.0 6.0 22.2% 1 206.21s 6,057 327,340 0
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 46.85s 14,934 421 7,906
Step 3.7 Flash 10.0 10.0 100.0% 0 13.01s 13,638 8,802 0
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 46.91s 7,782 270 14,916
Step 3.7 Flash 10.0 10.0 100.0% 0 14.72s 7,368 23,113 0
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 5.3 10.0 33.3% 0 17.50s 444 35 16,680
Step 3.7 Flash 4.1 4.4 44.5% 2 149.64s 783 410,502 0
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 4.7 1.6 66.7% 1 79.86s 344 73 8,675
Step 3.7 Flash 5.5 10.0 0.0% 0 4.17s 510 2,862 0
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 31.93s 699 101 7,704
Step 3.7 Flash 9.8 10.0 100.0% 0 1.52s 705 2,010 0
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 32.50s 696 301 13,853
Step 3.7 Flash 5.3 7.2 44.4% 1 10.22s 711 25,422 0
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 7.54s 8,193 309 909
Step 3.7 Flash 10.0 10.0 100.0% 0 2.79s 7,701 1,172 0
Culture générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 103.81s 204 24 17,130
Step 3.7 Flash 3.0 10.0 0.0% 0 149.34s 222 147,476 0

Comparaison rapide

Changer la paire de comparaison