नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

xAI: Grok 4.20 vs Z.ai: GLM 4.7 Flash

सारांश

Grok 4.20 vs GLM 4.7 Flash benchmark तुलना: Grok 4.20 average score में आगे है: 4.4 vs 4.3. GLM 4.7 Flash की benchmark लागत कम है: $0.054 vs $0.057. Grok 4.20 तेज है: 1.11s vs 35.10s, pass rates 28.6% vs 33.3%.

अनुशंसित मॉडल: Grok 4.20 - It has the best score here (4.4), while responding about 31.6x faster than GLM 4.7 Flash.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-02

मेट्रिक Grok 4.20 Grok 4.20 none रिलीज़: 2026-03-31 GLM 4.7 Flash GLM 4.7 Flash medium रिलीज़: 2026-01-19
स्कोर 4.4 4.3
रैंक #160 #162
विश्वसनीयता लागू नहीं 6.7
संगति 8.5 6.8
सही परीक्षण
प्रति प्रयास पास दर 28.6% 33.3%
अस्थिर टेस्ट 0 8
कुल रन 54 63
प्रति परिणाम लागत 1.570 1.337
कुल लागत $0.057 $0.054
इनपुट कीमत $1.250 / 1M $0.060 / 1M
आउटपुट कीमत $2.500 / 1M $0.400 / 1M
कुल इनपुट टोकन 41,313 37,206
आउटपुट टोकन 1,923 43,754
रीजनिंग टोकन 0 89,079
प्रतिक्रिया समय (औसत) 1.11s 35.10s
प्रतिक्रिया समय (अधिकतम) 6.04s 174.55s
प्रतिक्रिया समय (कुल) 19.96s 456.24s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#160 xAI: Grok 4.20

none
लागत
$0.004
समय
6.5s
टोकन
1,367 tok

#162 GLM 4.7 Flash

medium
अमान्य SVG
लागत
$0.000
समय
186.2s
टोकन
12,112 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 4.8 10.0 25.0% 0 501ms 1,986 267 0
GLM 4.7 Flash 4.7 5.9 41.7% 2 14.95s 555 1,122 6,110
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0
GLM 4.7 Flash 3.2 7.4 11.1% 1 55.33s 3,106 4,981 22,387
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 3.0 10.0 0.0% 0 6.04s 17,673 282 0
GLM 4.7 Flash 2.8 2.1 33.3% 1 65.57s 17,185 2,585 20,648
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 10.0 10.0 100.0% 0 522ms 7,749 207 0
GLM 4.7 Flash 6.3 10.0 50.0% 0 1.51s 7,107 584 2,755
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 3.0 10.0 0.0% 0 687ms 1,746 325 0
GLM 4.7 Flash 3.5 4.4 33.3% 2 174.55s 643 33,000 25,394
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 4.8 10.0 0.0% 0 659ms 819 83 0
GLM 4.7 Flash 3.6 9.7 0.0% 0 18.14s 318 18 2,138
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 6.3 10.0 50.0% 0 445ms 1,350 60 0
GLM 4.7 Flash 6.2 5.8 66.7% 1 2.97s 636 388 2,181
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 5.3 10.0 33.3% 0 473ms 1,671 198 0
GLM 4.7 Flash 2.9 7.2 11.1% 1 12.93s 521 781 5,255
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 10.0 10.0 100.0% 0 4.63s 7,245 189 0
GLM 4.7 Flash 10.0 10.0 100.0% 0 15.95s 6,949 224 1,014
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 0.0 0.0 0.0% 0 0ms 0 0 0
GLM 4.7 Flash 3.0 10.0 0.0% 0 11.13s 186 71 1,197

त्वरित तुलना

तुलना जोड़ी बदलें