नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Grok 4.5 (medium) vs GLM 5.2 (medium)

Grok 4.5 (medium) average score मध्ये पुढे आहे: 8.5 vs 7.8. GLM 5.2 (medium) चा benchmark खर्च कमी आहे: $0.224 vs $2.042. GLM 5.2 (medium) वेगवान आहे: 23.28s vs 68.59s, pass rates 83.3% vs 80.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-20

क्रमांक
#37
एकूण आउटपुट टोकन्स
299,460
प्रतिसाद वेळ (सरासरी)
68.59s
एकूण खर्च
$2.042
क्रमांक
#65
एकूण आउटपुट टोकन्स
61,761
प्रतिसाद वेळ (सरासरी)
23.28s
एकूण खर्च
$0.224
शिफारस केलेले मॉडेल GLM 5.2 (medium)

Its score stays close to the best score here (7.8 vs 8.5), while costing about 9.1x less than Grok 4.5 (medium).

तपशीलवार तुलना

मेट्रिक Grok 4.5 Grok 4.5 medium प्रकाशन: 2026-07-08 GLM 5.2 GLM 5.2 medium प्रकाशन: 2026-06-17
स्कोअर 8.5 7.8
क्रमांक #37 #65
विश्वसनीयता 10.0 9.5
सुसंगतता 8.9 8.0
प्रयत्न 66/66 63/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 83.3% 80.3%
अस्थिर चाचण्या 3 4
एकूण रन 66 63
प्रति निकाल खर्च 12.007 2.159
एकूण खर्च $2.042 $0.224
इनपुट किंमत $2.000 / 1M $0.966 / 1M
आउटपुट किंमत $6.000 / 1M $3.036 / 1M
एकूण इनपुट टोकन्स 122,155 37,199
आउटपुट टोकन्स 5,514 12,261
रिझनिंग टोकन्स 293,946 49,500
प्रतिसाद वेळ (सरासरी) 68.59s 23.28s
प्रतिसाद वेळ (कमाल) 436.38s 101.36s
प्रतिसाद वेळ (एकूण) 1508.91s 488.94s
पॅरामीटर्स ~1.7T एकूण (~170B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 SpaceXAI: Grok 4.5

medium
खर्च
$0.044
वेळ
59.4s
टोकन्स
7,512 tok

#65 GLM 5.2

medium
खर्च
$0.041
वेळ
195.8s
टोकन्स
9,287 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

झटपट तुलना

तुलना जोडी बदला

Muse Spark 1.2lowvsGrok 4.5mediumQwen3.8 27BlowvsGLM 5.2mediumGPT-5.2 ChatnonevsGLM 5.2mediumQwen3.8 27BhighvsGrok 4.5mediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumQwen3.7 FlashhighvsGLM 5.2mediumQwen3.8 MaxlowvsGrok 4.5mediumInkling SmallhighvsGrok 4.5mediumGPT-5.6 TerrahighvsGLM 5.2mediumSeed-2.0-CodelowvsGLM 5.2mediumMuse Spark 1.1lowvsGrok 4.5medium