नेव्हिगेशन
Advertise here

Grok 4.3 (medium) vs GLM 5.2

average score जवळपास समान आहे: 6.5 vs 6.5. GLM 5.2 चा benchmark खर्च कमी आहे: $0.161 vs $0.989. GLM 5.2 वेगवान आहे: 11.51s vs 44.53s, pass rates 63.8% vs 62.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#199
एकूण आउटपुट टोकन्स
232,542
प्रतिसाद वेळ (सरासरी)
44.53s
एकूण खर्च
$0.989
क्रमांक
#197
एकूण आउटपुट टोकन्स
19,230
प्रतिसाद वेळ (सरासरी)
11.51s
एकूण खर्च
$0.161
शिफारस केलेले मॉडेल GLM 5.2

It has the best score here (6.5), while costing about 6.2x less than Grok 4.3 (medium).

तपशीलवार तुलना

मेट्रिक Grok 4.3 Grok 4.3 medium प्रकाशन: 2026-05-01 GLM 5.2 GLM 5.2 none प्रकाशन: 2026-06-17
स्कोअर 6.5 6.5
क्रमांक #199 #197
विश्वसनीयता 10.0 10.0
सुसंगतता 8.3 9.0
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.8% 62.3%
अस्थिर चाचण्या 5 3
एकूण रन 69 69
प्रति निकाल खर्च 8.235 1.825
एकूण खर्च $0.989 $0.161
इनपुट किंमत $1.250 / 1M $0.325 / 1M
आउटपुट किंमत $2.500 / 1M $3.990 / 1M
एकूण इनपुट टोकन्स 325,471 257,698
आउटपुट टोकन्स 14,867 19,230
रिझनिंग टोकन्स 217,675 0
प्रतिसाद वेळ (सरासरी) 44.53s 11.51s
प्रतिसाद वेळ (कमाल) 216.69s 79.65s
प्रतिसाद वेळ (एकूण) 1024.25s 264.72s
पॅरामीटर्स ~1.5T एकूण (~150B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#199 SpaceXAI: Grok 4.3

medium
खर्च
$0.009
वेळ
19.0s
टोकन्स
3,661 tok

#197 GLM 5.2

none
खर्च
$0.033
वेळ
87.7s
टोकन्स
7,455 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

झटपट तुलना

तुलना जोडी बदला