नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

StepFun: Step 3.5 Flash vs Z.ai: GLM 5

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-16

मेट्रिक Step 3.5 Flash Step 3.5 Flash medium रिलीज़: 2026-02-01 GLM 5 GLM 5 none रिलीज़: 2026-02-12
स्कोर 7.9 6.6
रैंक #30 #52
संगति 9.1 9.6
सही परीक्षण
प्रति प्रयास पास दर 70.6% 51.9%
अस्थिर टेस्ट 2 1
कुल रन 49 54
प्रति परिणाम लागत 0.000 0.217
कुल लागत $0.000 $0.020
???? ??? $0.100 / 1M $0.720 / 1M
????? ??? $0.300 / 1M $2.300 / 1M
आउटपुट टोकन 71,904 1,959
रीजनिंग टोकन 155,607 0
प्रतिक्रिया समय (औसत) 26.78s 4.23s
प्रतिक्रिया समय (अधिकतम) 170.45s 11.07s
प्रतिक्रिया समय (कुल) 294.58s 46.51s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 10.0 10.0 100.0% 0 13.56s 14,376 17,668
GLM 5 4.8 10.0 25.0% 0 2.37s 275 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 1,176 12,984
GLM 5 3.0 10.0 0.0% 0 4.98s 406 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 600 13,886
GLM 5 10.0 10.0 100.0% 0 5.78s 203 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 45,350 90,436
GLM 5 3.0 10.0 0.0% 0 2.24s 19 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 5.5 10.0 0.0% 0 6.54s 2,214 2,584
GLM 5 10.0 10.0 100.0% 0 3.27s 103 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 8.5 6.8 83.3% 1 4.98s 2,284 3,412
GLM 5 10.0 10.0 100.0% 0 1.48s 61 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 5.3 10.0 33.3% 0 7.72s 5,629 10,835
GLM 5 7.7 10.0 66.7% 0 2.05s 264 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 275 3,802
GLM 5 10.0 10.0 100.0% 0 11.07s 220 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.5 Flash - - - - - - - -
GLM 5 5.6 3.5 33.3% 1 8.84s 408 0

त्वरित तुलना

तुलना जोड़ी बदलें