Navigation
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5 Nano vs StepFun: Step 3.7 Flash

Résumé

Comparaison benchmark GPT-5 Nano vs Step 3.7 Flash : Step 3.7 Flash mène au score moyen avec 7.1 vs 6.7. GPT-5 Nano a le coût de benchmark le plus bas avec $0.081 vs $1.148. GPT-5 Nano est plus rapide avec 42.51s vs 64.46s, avec des taux de réussite de 57.1% vs 63.5%.

Modèle recommandé: GPT-5 Nano - Son score reste proche du meilleur score ici (6.7 vs 7.1) tout en coûtant environ 14.2x moins que Step 3.7 Flash.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-18

Métrique GPT-5 Nano GPT-5 Nano medium Sortie: 2025-08-07 Step 3.7 Flash Step 3.7 Flash high Sortie: 2026-05-29
Score 6.7 7.1
Rang #79 #63
Fiabilité 10.0 10.0
Cohérence 7.3 8.2
Tests corrects
Taux de réussite par tentative 57.1% 63.5%
Tests instables 7 4
Exécutions totales 63 63
Coût par résultat 0.897 10.434
Coût total $0.081 $1.148
Prix d'entrée $0.050 / 1M $0.200 / 1M
Prix de sortie $0.400 / 1M $1.150 / 1M
Total des jetons d'entrée 34,108 38,391
Jetons de sortie 5,464 991,355
Jetons de raisonnement 192,064 0
Temps de réponse (moy.) 42.51s 64.46s
Temps de réponse (max) 204.02s 364.99s
Temps de réponse (total) 595.09s 1353.57s

Génération showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#79 GPT-5 Nano

medium
Coût
$0.006
Temps
108.5s
Tokens
13,209 tok

#63 Step 3.7 Flash

high
Coût
$0.007
Temps
63.6s
Tokens
6,030 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5 Nano 6.5 7.9 58.3% 1 25.50s 606 1,221 21,184
Step 3.7 Flash 10.0 10.0 100.0% 0 13.40s 696 42,656 0
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5 Nano 7.0 7.7 55.6% 1 41.62s 7,305 740 41,152
Step 3.7 Flash 4.0 6.0 22.2% 1 206.21s 6,057 327,340 0
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5 Nano 10.0 10.0 100.0% 0 65.96s 11,019 578 17,984
Step 3.7 Flash 10.0 10.0 100.0% 0 13.01s 13,638 8,802 0
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5 Nano 3.7 1.7 50.0% 2 21.42s 7,140 453 10,560
Step 3.7 Flash 10.0 10.0 100.0% 0 14.72s 7,368 23,113 0
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5 Nano 5.2 4.4 55.6% 2 204.02s 619 237 64,448
Step 3.7 Flash 4.1 4.4 44.5% 2 149.64s 783 410,502 0
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5 Nano 4.1 10.0 0.0% 0 17.51s 477 202 4,608
Step 3.7 Flash 5.5 10.0 0.0% 0 4.17s 510 2,862 0
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5 Nano 9.8 10.0 100.0% 0 15.64s 660 312 4,736
Step 3.7 Flash 9.8 10.0 100.0% 0 1.52s 705 2,010 0
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5 Nano 5.3 7.2 44.4% 1 20.63s 642 929 14,272
Step 3.7 Flash 5.3 7.2 44.4% 1 10.22s 711 25,422 0
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5 Nano 10.0 10.0 100.0% 0 33.30s 5,445 558 6,976
Step 3.7 Flash 10.0 10.0 100.0% 0 2.79s 7,701 1,172 0
Culture générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5 Nano 3.0 10.0 0.0% 0 20.13s 195 234 6,144
Step 3.7 Flash 3.0 10.0 0.0% 0 149.34s 222 147,476 0

Comparaison rapide

Changer la paire de comparaison