नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

xAI: Grok 4.20 vs Z.ai: GLM 4.7 Flash

सारांश

Grok 4.20 vs GLM 4.7 Flash benchmark तुलना: Grok 4.20 average score मध्ये पुढे आहे: 4.4 vs 4.3. GLM 4.7 Flash चा benchmark खर्च कमी आहे: $0.054 vs $0.057. Grok 4.20 वेगवान आहे: 1.11s vs 35.10s, pass rates 28.6% vs 33.3%.

शिफारस केलेले मॉडेल: Grok 4.20 - It has the best score here (4.4), while responding about 31.6x faster than GLM 4.7 Flash.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-02

मेट्रिक Grok 4.20 Grok 4.20 none प्रकाशन: 2026-03-31 GLM 4.7 Flash GLM 4.7 Flash medium प्रकाशन: 2026-01-19
स्कोअर 4.4 4.3
क्रमांक #160 #162
विश्वसनीयता लागू नाही 6.7
सुसंगतता 8.5 6.8
बरोबर चाचण्या
प्रति प्रयत्न पास दर 28.6% 33.3%
अस्थिर चाचण्या 0 8
एकूण रन 54 63
प्रति निकाल खर्च 1.570 1.337
एकूण खर्च $0.057 $0.054
इनपुट किंमत $1.250 / 1M $0.060 / 1M
आउटपुट किंमत $2.500 / 1M $0.400 / 1M
एकूण इनपुट टोकन्स 41,313 37,206
आउटपुट टोकन्स 1,923 43,754
रिझनिंग टोकन्स 0 89,079
प्रतिसाद वेळ (सरासरी) 1.11s 35.10s
प्रतिसाद वेळ (कमाल) 6.04s 174.55s
प्रतिसाद वेळ (एकूण) 19.96s 456.24s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#160 xAI: Grok 4.20

none
खर्च
$0.004
वेळ
6.5s
टोकन्स
1,367 tok

#162 GLM 4.7 Flash

medium
अवैध SVG
खर्च
$0.000
वेळ
186.2s
टोकन्स
12,112 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 4.8 10.0 25.0% 0 501ms 1,986 267 0
GLM 4.7 Flash 4.7 5.9 41.7% 2 14.95s 555 1,122 6,110
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0
GLM 4.7 Flash 3.2 7.4 11.1% 1 55.33s 3,106 4,981 22,387
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 3.0 10.0 0.0% 0 6.04s 17,673 282 0
GLM 4.7 Flash 2.8 2.1 33.3% 1 65.57s 17,185 2,585 20,648
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 10.0 10.0 100.0% 0 522ms 7,749 207 0
GLM 4.7 Flash 6.3 10.0 50.0% 0 1.51s 7,107 584 2,755
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 3.0 10.0 0.0% 0 687ms 1,746 325 0
GLM 4.7 Flash 3.5 4.4 33.3% 2 174.55s 643 33,000 25,394
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 4.8 10.0 0.0% 0 659ms 819 83 0
GLM 4.7 Flash 3.6 9.7 0.0% 0 18.14s 318 18 2,138
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 6.3 10.0 50.0% 0 445ms 1,350 60 0
GLM 4.7 Flash 6.2 5.8 66.7% 1 2.97s 636 388 2,181
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 5.3 10.0 33.3% 0 473ms 1,671 198 0
GLM 4.7 Flash 2.9 7.2 11.1% 1 12.93s 521 781 5,255
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 10.0 10.0 100.0% 0 4.63s 7,245 189 0
GLM 4.7 Flash 10.0 10.0 100.0% 0 15.95s 6,949 224 1,014
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 0.0 0.0 0.0% 0 0ms 0 0 0
GLM 4.7 Flash 3.0 10.0 0.0% 0 11.13s 186 71 1,197

झटपट तुलना

तुलना जोडी बदला