नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

StepFun: Step 3.7 Flash vs Z.ai: GLM 5

सारांश

Step 3.7 Flash vs GLM 5 benchmark तुलना: GLM 5 average score मध्ये पुढे आहे: 8.6 vs 7.7. GLM 5 चा benchmark खर्च कमी आहे: $0.228 vs $0.341. Step 3.7 Flash वेगवान आहे: 15.74s vs 33.54s, pass rates 68.3% vs 82.5%.

शिफारस केलेले मॉडेल: GLM 5 - It has the best score here (8.6), while costing about 1.5x less than Step 3.7 Flash.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-17

मेट्रिक Step 3.7 Flash Step 3.7 Flash low प्रकाशन: 2026-05-29 GLM 5 GLM 5 medium प्रकाशन: 2026-02-12
स्कोअर 7.7 8.6
क्रमांक #39 #15
विश्वसनीयता 10.0 10.0
सुसंगतता 8.4 8.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 68.3% 82.5%
अस्थिर चाचण्या 4 4
एकूण रन 63 63
प्रति निकाल खर्च 2.840 1.668
एकूण खर्च $0.341 $0.228
इनपुट किंमत $0.200 / 1M $0.600 / 1M
आउटपुट किंमत $1.150 / 1M $1.920 / 1M
एकूण इनपुट टोकन्स 40,101 35,224
आउटपुट टोकन्स 289,325 21,570
रिझनिंग टोकन्स 0 102,996
प्रतिसाद वेळ (सरासरी) 15.74s 33.54s
प्रतिसाद वेळ (कमाल) 124.75s 99.85s
प्रतिसाद वेळ (एकूण) 330.63s 435.99s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#39 Step 3.7 Flash

low
Invalid SVG
Cost
$0.004
Time
25.3s
Tokens
3,072 tok

#15 GLM 5

medium
Cost
$0.005
Time
20.7s
Tokens
2,068 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 8.7 7.9 91.7% 1 4.02s 756 10,896 0
GLM 5 10.0 10.0 100.0% 0 23.66s 555 480 7,056
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 8.2 7.2 88.9% 1 9.46s 7,437 18,685 0
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 10.0 10.0 100.0% 0 7.98s 13,683 6,426 0
GLM 5 10.0 10.0 100.0% 0 28.96s 12,804 662 3,242
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 7.3 5.8 83.3% 1 2.29s 7,398 2,667 0
GLM 5 7.1 5.6 83.3% 1 8.90s 5,508 567 3,734
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 5.3 7.2 44.4% 1 43.31s 828 104,487 0
GLM 5 3.5 4.4 33.3% 2 0ms 260 13,176 14,137
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 3.4 9.3 0.0% 0 7.00s 525 4,604 0
GLM 5 6.1 3.1 66.7% 1 14.69s 477 2,020 2,248
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 9.8 10.0 100.0% 0 1.58s 735 1,857 0
GLM 5 10.0 10.0 100.0% 0 7.25s 636 1,001 2,129
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 5.5 9.9 33.3% 0 1.84s 756 3,564 0
GLM 5 10.0 10.0 100.0% 0 11.33s 609 33 4,076
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 10.0 10.0 100.0% 0 3.25s 7,746 1,360 0
GLM 5 10.0 10.0 100.0% 0 15.93s 6,935 233 994
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 3.0 10.0 0.0% 0 124.75s 237 134,779 0
GLM 5 3.0 10.0 0.0% 0 67.37s 186 401 12,450

झटपट तुलना

तुलना जोडी बदला