नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

OpenAI: GPT-5 Mini vs StepFun: Step 3.5 Flash

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-01

मेट्रिक GPT-5 Mini GPT-5 Mini medium रिलीज़: 2025-08-07 Step 3.5 Flash Step 3.5 Flash medium रिलीज़: 2026-02-01
स्कोर 7.2 7.4
रैंक #73 #61
विश्वसनीयता 10.0 10.0
संगति 9.1 9.1
सही परीक्षण
प्रति प्रयास पास दर 61.7% 61.4%
अस्थिर टेस्ट 2 2
कुल रन 60 57
प्रति परिणाम लागत 1.348 0.133
कुल लागत $0.149 $0.062
इनपुट कीमत $0.250 / 1M $0.090 / 1M
आउटपुट कीमत $2.000 / 1M $0.300 / 1M
आउटपुट टोकन 6,723 90,478
रीजनिंग टोकन 63,082 173,544
प्रतिक्रिया समय (औसत) 23.75s 43.20s
प्रतिक्रिया समय (अधिकतम) 88.15s 170.45s
प्रतिक्रिया समय (कुल) 475.03s 561.54s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5 Mini 7.1 7.6 66.7% 1 13.86s 1,715 6,378
Step 3.5 Flash 10.0 10.0 100.0% 0 40.57s 20,391 24,176
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5 Mini 10.0 10.0 100.0% 0 30.74s 580 12,544
Step 3.5 Flash 2.5 6.0 33.3% 1 62.83s 12,098 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5 Mini 10.0 10.0 100.0% 0 88.15s 754 11,520
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 1,176 12,984
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5 Mini 10.0 10.0 100.0% 0 12.58s 453 3,200
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 600 13,886
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5 Mini 3.6 7.2 22.2% 1 44.63s 293 14,016
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 45,350 90,436
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5 Mini 4.5 10.0 0.0% 0 13.50s 349 1,856
Step 3.5 Flash 5.5 10.0 0.0% 0 22.39s 240 3,506
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5 Mini 10.0 10.0 100.0% 0 11.59s 310 3,968
Step 3.5 Flash 8.3 10.0 50.0% 0 4.78s 2,364 3,521
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5 Mini 5.6 9.8 33.3% 0 15.20s 1,622 6,144
Step 3.5 Flash 5.3 10.0 33.3% 0 7.22s 5,630 10,861
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5 Mini 10.0 10.0 100.0% 0 18.64s 487 1,600
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 275 3,802
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5 Mini 3.0 10.0 0.0% 0 9.99s 160 1,856
Step 3.5 Flash 3.0 10.0 0.0% 0 108.45s 2,354 10,372

त्वरित तुलना

तुलना जोड़ी बदलें