नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

Grok 4.20 Multi Agent Beta vs Z.ai: GLM 5V Turbo

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-02

मेट्रिक Grok 4.20 Multi Agent Beta Grok 4.20 Multi Agent Beta medium रिलीज़: 2026-03-12 GLM 5V Turbo GLM 5V Turbo none रिलीज़: 2026-04-01
स्कोर 6.2 6.0
रैंक #53 #55
संगति 7.2 10.0
सही परीक्षण
प्रति प्रयास पास दर 54.9% 41.2%
अस्थिर टेस्ट 6 0
कुल रन 51 51
प्रति परिणाम लागत 82.962 0.588
कुल लागत $4.978 $0.042
???? ??? $0.000 / 1M $1.200 / 1M
????? ??? $0.000 / 1M $4.000 / 1M
आउटपुट टोकन 298,948 1,388
रीजनिंग टोकन 296,529 0
प्रतिक्रिया समय (औसत) 8.64s 2.97s
प्रतिक्रिया समय (अधिकतम) 35.28s 6.51s
प्रतिक्रिया समय (कुल) 129.64s 50.57s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi Agent Beta 6.9 5.8 75.0% 2 3.46s 33,706 33,077
GLM 5V Turbo 4.8 10.0 25.0% 0 3.13s 281 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi Agent Beta 3.0 10.0 0.0% 0 0ms 0 0
GLM 5V Turbo 3.0 10.0 0.0% 0 6.51s 276 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi Agent Beta 10.0 10.0 100.0% 0 5.54s 25,306 25,051
GLM 5V Turbo 10.0 10.0 100.0% 0 3.81s 204 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi Agent Beta 2.9 7.2 11.1% 1 24.67s 164,609 163,647
GLM 5V Turbo 5.3 10.0 33.3% 0 2.09s 24 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi Agent Beta 5.8 2.8 66.7% 1 6.40s 15,848 15,746
GLM 5V Turbo 4.6 10.0 0.0% 0 2.22s 114 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi Agent Beta 8.3 10.0 50.0% 0 4.63s 25,457 25,322
GLM 5V Turbo 6.5 10.0 50.0% 0 1.97s 60 0
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi Agent Beta 7.2 5.1 77.8% 2 5.01s 34,022 33,686
GLM 5V Turbo 5.3 10.0 33.3% 0 2.22s 207 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi Agent Beta 3.0 10.0 0.0% 0 0ms 0 0
GLM 5V Turbo 10.0 10.0 100.0% 0 4.86s 222 0

त्वरित तुलना

तुलना जोड़ी बदलें