नेव्हिगेशन
Advertise here

Grok 4.3 (medium) vs GLM 5.3 (low)

average score जवळपास समान आहे: 6.5 vs 6.5. GLM 5.3 (low) चा benchmark खर्च कमी आहे: $0.473 vs $0.989. GLM 5.3 (low) वेगवान आहे: 15.28s vs 44.53s, pass rates 63.8% vs 63.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#199
एकूण आउटपुट टोकन्स
232,542
प्रतिसाद वेळ (सरासरी)
44.53s
एकूण खर्च
$0.989
क्रमांक
#195
एकूण आउटपुट टोकन्स
28,602
प्रतिसाद वेळ (सरासरी)
15.28s
एकूण खर्च
$0.473
शिफारस केलेले मॉडेल GLM 5.3 (low)

It has the best score here (6.5), while costing about 2.1x less than Grok 4.3 (medium).

तपशीलवार तुलना

मेट्रिक Grok 4.3 Grok 4.3 medium प्रकाशन: 2026-05-01 GLM 5.3 GLM 5.3 low प्रकाशन: 2026-08-20
स्कोअर 6.5 6.5
क्रमांक #199 #195
विश्वसनीयता 10.0 10.0
सुसंगतता 8.3 8.3
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.8% 63.8%
अस्थिर चाचण्या 5 5
एकूण रन 69 69
प्रति निकाल खर्च 8.235 3.936
एकूण खर्च $0.989 $0.473
इनपुट किंमत $1.250 / 1M $1.400 / 1M
आउटपुट किंमत $2.500 / 1M $4.400 / 1M
एकूण इनपुट टोकन्स 325,471 247,436
आउटपुट टोकन्स 14,867 11,005
रिझनिंग टोकन्स 217,675 17,597
प्रतिसाद वेळ (सरासरी) 44.53s 15.28s
प्रतिसाद वेळ (कमाल) 216.69s 83.60s
प्रतिसाद वेळ (एकूण) 1024.25s 351.49s
पॅरामीटर्स ~1.5T एकूण (~150B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#199 SpaceXAI: Grok 4.3

medium
खर्च
$0.009
वेळ
19.0s
टोकन्स
3,661 tok

#195 GLM 5.3

low
खर्च
$0.007
वेळ
28.4s
टोकन्स
1,599 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

झटपट तुलना

तुलना जोडी बदला