नेव्हिगेशन
AI BENCHY
Advertise here

Grok 4.6 (low) vs GLM 5.3 (high)

average score जवळपास समान आहे: 7.4 vs 7.3. GLM 5.3 (high) चा benchmark खर्च कमी आहे: $0.403 vs $0.449. Grok 4.6 (low) वेगवान आहे: 14.55s vs 27.82s, pass rates 69.7% vs 74.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-20

क्रमांक
#96
एकूण आउटपुट टोकन्स
38,048
प्रतिसाद वेळ (सरासरी)
14.55s
एकूण खर्च
$0.449
क्रमांक
#99
एकूण आउटपुट टोकन्स
63,667
प्रतिसाद वेळ (सरासरी)
27.82s
एकूण खर्च
$0.403
शिफारस केलेले मॉडेल Grok 4.6 (low)

It has the best score here (7.4), while responding about 1.9x faster than GLM 5.3 (high).

तपशीलवार तुलना

मेट्रिक Grok 4.6 Grok 4.6 low प्रकाशन: 2026-08-12 GLM 5.3 GLM 5.3 high प्रकाशन: 2026-08-20
स्कोअर 7.4 7.3
क्रमांक #96 #99
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 7.5
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 69.7% 74.2%
अस्थिर चाचण्या 1 7
एकूण रन 66 66
प्रति निकाल खर्च 2.989 3.099
एकूण खर्च $0.449 $0.403
इनपुट किंमत $2.000 / 1M $1.400 / 1M
आउटपुट किंमत $6.000 / 1M $4.400 / 1M
एकूण इनपुट टोकन्स 109,960 87,601
आउटपुट टोकन्स 5,124 6,006
रिझनिंग टोकन्स 32,924 57,661
प्रतिसाद वेळ (सरासरी) 14.55s 27.82s
प्रतिसाद वेळ (कमाल) 26.46s 159.91s
प्रतिसाद वेळ (एकूण) 320.17s 612.06s
पॅरामीटर्स ~1.7T एकूण (~170B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 SpaceXAI: Grok 4.6

low
खर्च
$0.011
वेळ
26.0s
टोकन्स
1,941 tok

#99 GLM 5.3

high
खर्च
$0.085
वेळ
362.5s
टोकन्स
19,310 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

झटपट तुलना

तुलना जोडी बदला