नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.4 Nano vs StepFun: Step 3.7 Flash

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-01

मेट्रिक GPT-5.4 Nano GPT-5.4 Nano medium प्रकाशन: 2026-03-17 Step 3.7 Flash Step 3.7 Flash low प्रकाशन: 2026-05-29
स्कोअर 7.2 7.4
क्रमांक #72 #59
विश्वसनीयता 10.0 10.0
सुसंगतता 8.8 8.7
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.3% 68.3%
अस्थिर चाचण्या 3 3
एकूण रन 60 60
प्रति निकाल खर्च 0.900 2.796
एकूण खर्च $0.099 $0.336
इनपुट किंमत $0.200 / 1M $0.200 / 1M
आउटपुट किंमत $1.250 / 1M $1.150 / 1M
आउटपुट टोकन्स 2,993 285,209
रिझनिंग टोकन्स 70,928 0
प्रतिसाद वेळ (सरासरी) 11.79s 16.06s
प्रतिसाद वेळ (कमाल) 94.06s 124.75s
प्रतिसाद वेळ (एकूण) 235.81s 321.11s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 683 2,254
Step 3.7 Flash 8.7 7.9 91.7% 1 4.02s 10,896 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 6.8 6.2 66.7% 1 21.10s 495 15,186
Step 3.7 Flash 10.0 10.0 100.0% 0 9.43s 14,569 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 349 5,719
Step 3.7 Flash 10.0 10.0 100.0% 0 7.98s 6,426 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 234 516
Step 3.7 Flash 7.3 5.8 83.3% 1 2.29s 2,667 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 60 43,325
Step 3.7 Flash 5.3 7.2 44.4% 1 43.31s 104,487 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 179 443
Step 3.7 Flash 3.4 9.3 0.0% 0 7.00s 4,604 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 95 521
Step 3.7 Flash 9.8 10.0 100.0% 0 1.58s 1,857 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 4.1 7.2 22.2% 1 3.79s 594 1,408
Step 3.7 Flash 5.5 9.9 33.3% 0 1.84s 3,564 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 234 382
Step 3.7 Flash 10.0 10.0 100.0% 0 3.25s 1,360 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 3.0 10.0 0.0% 0 4.81s 70 1,174
Step 3.7 Flash 3.0 10.0 0.0% 0 124.75s 134,779 0

झटपट तुलना

तुलना जोडी बदला