नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

xAI: Grok 4.20 vs Z.ai: GLM 5.2

सारांश

Grok 4.20 vs GLM 5.2 benchmark तुलना: Grok 4.20 average score मध्ये पुढे आहे: 7.3 vs 7.1. GLM 5.2 चा benchmark खर्च कमी आहे: $0.076 vs $0.609. GLM 5.2 वेगवान आहे: 6.34s vs 27.68s, pass rates 63.5% vs 60.3%.

शिफारस केलेले मॉडेल: GLM 5.2 - Its score stays close to the best score here (7.1 vs 7.3), while costing about 8.1x less than Grok 4.20.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-17

मेट्रिक Grok 4.20 Grok 4.20 medium प्रकाशन: 2026-03-31 GLM 5.2 GLM 5.2 none प्रकाशन: 2026-06-17
स्कोअर 7.3 7.1
क्रमांक #53 #61
विश्वसनीयता 10.0 9.9
सुसंगतता 8.8 9.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.5% 60.3%
अस्थिर चाचण्या 3 1
एकूण रन 63 63
प्रति निकाल खर्च 8.309 0.628
एकूण खर्च $0.609 $0.076
इनपुट किंमत $1.250 / 1M $1.400 / 1M
आउटपुट किंमत $2.500 / 1M $4.400 / 1M
एकूण इनपुट टोकन्स 44,433 38,671
आउटपुट टोकन्स 1,819 4,817
रिझनिंग टोकन्स 219,524 0
प्रतिसाद वेळ (सरासरी) 27.68s 6.34s
प्रतिसाद वेळ (कमाल) 199.66s 20.69s
प्रतिसाद वेळ (एकूण) 581.26s 133.19s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#53 xAI: Grok 4.20

medium
Cost
$0.041
Time
110.3s
Tokens
16,336 tok

#61 GLM 5.2

none
Invalid SVG
Cost
$0.033
Time
87.7s
Tokens
7,455 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 8.2 7.9 83.3% 1 3.95s 2,010 287 8,312
GLM 5.2 8.3 10.0 75.0% 0 3.70s 567 313 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 10.0 10.0 100.0% 0 17.40s 12,909 232 9,556
GLM 5.2 10.0 10.0 100.0% 0 20.69s 14,296 1,489 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 10.0 10.0 100.0% 0 4.17s 7,761 180 5,333
GLM 5.2 10.0 10.0 100.0% 0 7.17s 7,113 204 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 5.3 10.0 33.3% 0 27.03s 1,764 375 49,339
GLM 5.2 5.3 10.0 33.3% 0 6.50s 696 27 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 3.9 2.6 33.3% 1 24.48s 825 65 6,440
GLM 5.2 6.1 3.1 66.7% 1 4.42s 480 82 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 9.8 10.0 100.0% 0 4.26s 1,362 57 6,419
GLM 5.2 9.8 10.0 100.0% 0 3.84s 642 66 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 7.7 10.0 66.7% 0 6.22s 1,689 149 7,913
GLM 5.2 7.7 10.0 66.7% 0 3.31s 618 265 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 3.0 10.0 0.0% 0 13.68s 7,275 197 6,620
GLM 5.2 10.0 10.0 100.0% 0 15.76s 6,807 400 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 3.0 10.0 0.0% 0 63.48s 531 9 16,442
GLM 5.2 3.0 10.0 0.0% 0 3.41s 189 13 0

झटपट तुलना

तुलना जोडी बदला