नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

StepFun: Step 3.5 Flash vs Z.ai: GLM 5 Turbo

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-15

मेट्रिक Step 3.5 Flash Step 3.5 Flash medium रिलीज़: 2026-02-01 निःशुल्क उपलब्ध GLM 5 Turbo GLM 5 Turbo none रिलीज़: 2026-03-15
रैंक #25 #53
स्कोर 7.8 5.7
संगति 9.1 9.5
प्रति परिणाम लागत 0.000 0.467
कुल लागत $0.000 $0.028
सही परीक्षण
प्रति प्रयास पास दर 68.8% 39.6%
अस्थिर टेस्ट 2 1
कुल रन 48 48
आउटपुट टोकन 71,452 1,264
रीजनिंग टोकन 155,147 0
प्रतिक्रिया समय (औसत) 29.10s 2.92s
प्रतिक्रिया समय (अधिकतम) 170.45s 8.21s
प्रतिक्रिया समय (कुल) 290.96s 46.72s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 10.0 10.0 100.0% 0 18.54s 13,924 17,208
GLM 5 Turbo 3.0 10.0 0.0% 0 3.01s 376 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 1,176 12,984
GLM 5 Turbo 3.0 10.0 0.0% 0 4.89s 144 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 600 13,886
GLM 5 Turbo 10.0 10.0 100.0% 0 2.47s 204 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 45,350 90,436
GLM 5 Turbo 5.3 10.0 33.3% 0 1.97s 25 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 5.5 10.0 0.0% 0 6.54s 2,214 2,584
GLM 5 Turbo 4.2 9.9 0.0% 0 2.18s 48 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 8.5 6.8 83.3% 1 4.98s 2,284 3,412
GLM 5 Turbo 6.5 10.0 50.0% 0 2.13s 65 0
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 5.3 10.0 33.3% 0 7.72s 5,629 10,835
GLM 5 Turbo 5.5 7.4 44.4% 1 2.43s 180 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 275 3,802
GLM 5 Turbo 10.0 10.0 100.0% 0 8.21s 222 0

त्वरित तुलना

तुलना जोड़ी बदलें