नेव्हिगेशन
Advertise here

Grok 4.6 (medium) vs GLM 5.3 (high)

average score जवळपास समान आहे: 7.8 vs 7.8. GLM 5.3 (high) चा benchmark खर्च कमी आहे: $0.610 vs $2.270. GLM 5.3 (high) वेगवान आहे: 28.38s vs 74.77s, pass rates 78.3% vs 75.4%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#107
एकूण आउटपुट टोकन्स
266,197
प्रतिसाद वेळ (सरासरी)
74.77s
एकूण खर्च
$2.270
क्रमांक
#105
एकूण आउटपुट टोकन्स
68,482
प्रतिसाद वेळ (सरासरी)
28.38s
एकूण खर्च
$0.610
शिफारस केलेले मॉडेल GLM 5.3 (high)

It has the best score here (7.8), while costing about 3.7x less than Grok 4.6 (medium).

तपशीलवार तुलना

मेट्रिक Grok 4.6 Grok 4.6 medium प्रकाशन: 2026-08-12 GLM 5.3 GLM 5.3 high प्रकाशन: 2026-08-20
स्कोअर 7.8 7.8
क्रमांक #107 #105
विश्वसनीयता 10.0 10.0
सुसंगतता 8.7 7.6
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 78.3% 75.4%
अस्थिर चाचण्या 4 7
एकूण रन 69 69
प्रति निकाल खर्च 14.187 4.351
एकूण खर्च $2.270 $0.610
इनपुट किंमत $2.000 / 1M $1.400 / 1M
आउटपुट किंमत $6.000 / 1M $4.400 / 1M
एकूण इनपुट टोकन्स 336,351 219,811
आउटपुट टोकन्स 6,180 8,811
रिझनिंग टोकन्स 260,017 59,671
प्रतिसाद वेळ (सरासरी) 74.77s 28.38s
प्रतिसाद वेळ (कमाल) 514.35s 159.91s
प्रतिसाद वेळ (एकूण) 1719.73s 652.78s
पॅरामीटर्स ~1.7T एकूण (~170B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#107 SpaceXAI: Grok 4.6

medium
खर्च
$0.028
वेळ
72.1s
टोकन्स
4,771 tok

#105 GLM 5.3

high
खर्च
$0.085
वेळ
362.5s
टोकन्स
19,310 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

झटपट तुलना

तुलना जोडी बदला