Navigation
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.5 Plus 2026-02-15 vs StepFun: Step 3.7 Flash

Résumé

Comparaison benchmark Qwen3.5 Plus 2026-02-15 vs Step 3.7 Flash : Step 3.7 Flash mène au score moyen avec 7.1 vs 5.8. Qwen3.5 Plus 2026-02-15 a le coût de benchmark le plus bas avec $0.016 vs $1.148. Qwen3.5 Plus 2026-02-15 est plus rapide avec 2.31s vs 64.46s, avec des taux de réussite de 46.0% vs 63.5%.

Modèle recommandé: Qwen3.5 Plus 2026-02-15 - Il offre le meilleur compromis global: score compétitif (5.8), coût inférieur à Step 3.7 Flash et temps de réponse équilibré.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-18

Métrique Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none Sortie: 2026-02-15 Step 3.7 Flash Step 3.7 Flash high Sortie: 2026-05-29
Score 5.8 7.1
Rang #106 #63
Fiabilité 10.0 10.0
Cohérence 9.4 8.2
Tests corrects
Taux de réussite par tentative 46.0% 63.5%
Tests instables 2 4
Exécutions totales 63 63
Coût par résultat 0.204 10.434
Coût total $0.016 $1.148
Prix d'entrée $0.260 / 1M $0.200 / 1M
Prix de sortie $1.560 / 1M $1.150 / 1M
Total des jetons d'entrée 45,864 38,391
Jetons de sortie 2,480 991,355
Jetons de raisonnement 0 0
Temps de réponse (moy.) 2.31s 64.46s
Temps de réponse (max) 6.65s 364.99s
Temps de réponse (total) 34.63s 1353.57s

Génération showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#106 Qwen3.5 Plus 2026-02-15

none
Coût
$0.012
Temps
153.2s
Tokens
7,787 tok

#63 Step 3.7 Flash

high
Coût
$0.007
Temps
63.6s
Tokens
6,030 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 4.8 10.0 25.0% 0 1.91s 696 517 0
Step 3.7 Flash 10.0 10.0 100.0% 0 13.40s 696 42,656 0
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 4.3 7.9 11.1% 1 2.05s 7,913 473 0
Step 3.7 Flash 4.0 6.0 22.2% 1 206.21s 6,057 327,340 0
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 6.65s 18,304 314 0
Step 3.7 Flash 10.0 10.0 100.0% 0 13.01s 13,638 8,802 0
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 1.89s 7,794 243 0
Step 3.7 Flash 10.0 10.0 100.0% 0 14.72s 7,368 23,113 0
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 5.3 10.0 33.3% 0 1.17s 789 17 0
Step 3.7 Flash 4.1 4.4 44.5% 2 149.64s 783 410,502 0
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 4.4 3.0 33.3% 1 2.26s 522 117 0
Step 3.7 Flash 5.5 10.0 0.0% 0 4.17s 510 2,862 0
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 1.67s 711 72 0
Step 3.7 Flash 9.8 10.0 100.0% 0 1.52s 705 2,010 0
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 7.7 10.0 66.7% 0 2.71s 714 494 0
Step 3.7 Flash 5.3 7.2 44.4% 1 10.22s 711 25,422 0
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 3.33s 8,211 222 0
Step 3.7 Flash 10.0 10.0 100.0% 0 2.79s 7,701 1,172 0
Culture générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 1.11s 210 11 0
Step 3.7 Flash 3.0 10.0 0.0% 0 149.34s 222 147,476 0

Comparaison rapide

Changer la paire de comparaison