नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Grok 4.3 (medium) vs GLM 5.2

average score लगभग बराबर है: 6.5 vs 6.5. GLM 5.2 की benchmark लागत कम है: $0.161 vs $0.989. GLM 5.2 तेज है: 11.51s vs 44.53s, pass rates 63.8% vs 62.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#199
कुल आउटपुट टोकन
232,542
प्रतिक्रिया समय (औसत)
44.53s
कुल लागत
$0.989
रैंक
#197
कुल आउटपुट टोकन
19,230
प्रतिक्रिया समय (औसत)
11.51s
कुल लागत
$0.161
अनुशंसित मॉडल GLM 5.2

It has the best score here (6.5), while costing about 6.2x less than Grok 4.3 (medium).

विस्तृत तुलना

मेट्रिक Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01 GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 6.5 6.5
रैंक #199 #197
विश्वसनीयता 10.0 10.0
संगति 8.3 9.0
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 63.8% 62.3%
अस्थिर टेस्ट 5 3
कुल रन 69 69
प्रति परिणाम लागत 8.235 1.825
कुल लागत $0.989 $0.161
इनपुट कीमत $1.250 / 1M $0.325 / 1M
आउटपुट कीमत $2.500 / 1M $3.990 / 1M
कुल इनपुट टोकन 325,471 257,698
आउटपुट टोकन 14,867 19,230
रीजनिंग टोकन 217,675 0
प्रतिक्रिया समय (औसत) 44.53s 11.51s
प्रतिक्रिया समय (अधिकतम) 216.69s 79.65s
प्रतिक्रिया समय (कुल) 1024.25s 264.72s
पैरामीटर ~1.5T कुल (~150B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#199 SpaceXAI: Grok 4.3

medium
लागत
$0.009
समय
19.0s
टोकन
3,661 tok

#197 GLM 5.2

none
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

त्वरित तुलना

तुलना जोड़ी बदलें