नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

StepFun: Step 3.5 Flash vs Z.ai: GLM 5

सारांश

Step 3.5 Flash vs GLM 5 benchmark तुलना: Step 3.5 Flash average score मध्ये पुढे आहे: 6.6 vs 6.0. GLM 5 चा benchmark खर्च कमी आहे: $0.027 vs $0.070. GLM 5 वेगवान आहे: 4.03s vs 72.53s, pass rates 54.0% vs 44.4%.

शिफारस केलेले मॉडेल: GLM 5 - Its score stays close to the best score here (6.0 vs 6.6), while costing about 2.6x less than Step 3.5 Flash.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-18

मेट्रिक Step 3.5 Flash Step 3.5 Flash medium प्रकाशन: 2026-02-01 GLM 5 GLM 5 none प्रकाशन: 2026-02-12
स्कोअर 6.6 6.0
क्रमांक #80 #101
विश्वसनीयता 10.0 10.0
सुसंगतता 8.9 9.7
बरोबर चाचण्या
प्रति प्रयत्न पास दर 54.0% 44.4%
अस्थिर चाचण्या 1 1
एकूण रन 60 63
प्रति निकाल खर्च 0.198 0.263
एकूण खर्च $0.070 $0.027
इनपुट किंमत $0.090 / 1M $0.600 / 1M
आउटपुट किंमत $0.300 / 1M $1.920 / 1M
एकूण इनपुट टोकन्स 34,431 37,135
आउटपुट टोकन्स 91,587 1,989
रिझनिंग टोकन्स 195,973 0
प्रतिसाद वेळ (सरासरी) 72.53s 4.03s
प्रतिसाद वेळ (कमाल) 453.94s 11.07s
प्रतिसाद वेळ (एकूण) 1015.47s 56.37s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#80 Step 3.5 Flash

medium
खर्च
$0.008
वेळ
277.1s
टोकन्स
23,695 tok

#101 GLM 5

none
खर्च
$0.007
वेळ
32.1s
टोकन्स
2,023 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.5 Flash 10.0 10.0 100.0% 0 40.57s 694 20,391 24,176
GLM 5 4.8 10.0 25.0% 0 2.37s 510 275 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.5 Flash 2.4 5.2 0.0% 0 258.38s 2,211 13,207 22,429
GLM 5 4.0 7.8 11.1% 1 5.12s 7,256 428 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 13,638 1,176 12,984
GLM 5 3.0 10.0 0.0% 0 4.98s 12,812 406 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 7,368 600 13,886
GLM 5 10.0 10.0 100.0% 0 5.78s 7,107 203 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 673 45,350 90,436
GLM 5 3.0 10.0 0.0% 0 2.24s 643 19 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.5 Flash 5.5 10.0 0.0% 0 22.39s 509 240 3,506
GLM 5 10.0 10.0 100.0% 0 3.27s 477 103 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.5 Flash 8.3 10.0 50.0% 0 4.78s 705 2,364 3,521
GLM 5 10.0 10.0 100.0% 0 1.48s 636 61 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.5 Flash 5.3 10.0 33.3% 0 7.22s 711 5,630 10,861
GLM 5 7.7 10.0 66.7% 0 1.91s 609 261 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 7,701 275 3,802
GLM 5 10.0 10.0 100.0% 0 11.07s 6,899 220 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.5 Flash 3.0 10.0 0.0% 0 108.45s 221 2,354 10,372
GLM 5 3.0 10.0 0.0% 0 3.62s 186 13 0

झटपट तुलना

तुलना जोडी बदला