नेविगेशन
Advertise here

Grok 4.3 (medium) vs GLM 5.3 (low)

average score लगभग बराबर है: 6.5 vs 6.5. GLM 5.3 (low) की benchmark लागत कम है: $0.473 vs $0.989. GLM 5.3 (low) तेज है: 15.28s vs 44.53s, pass rates 63.8% vs 63.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#199
कुल आउटपुट टोकन
232,542
प्रतिक्रिया समय (औसत)
44.53s
कुल लागत
$0.989
रैंक
#195
कुल आउटपुट टोकन
28,602
प्रतिक्रिया समय (औसत)
15.28s
कुल लागत
$0.473
अनुशंसित मॉडल GLM 5.3 (low)

It has the best score here (6.5), while costing about 2.1x less than Grok 4.3 (medium).

विस्तृत तुलना

मेट्रिक Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01 GLM 5.3 GLM 5.3 low रिलीज़: 2026-08-20
स्कोर 6.5 6.5
रैंक #199 #195
विश्वसनीयता 10.0 10.0
संगति 8.3 8.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 63.8% 63.8%
अस्थिर टेस्ट 5 5
कुल रन 69 69
प्रति परिणाम लागत 8.235 3.936
कुल लागत $0.989 $0.473
इनपुट कीमत $1.250 / 1M $1.400 / 1M
आउटपुट कीमत $2.500 / 1M $4.400 / 1M
कुल इनपुट टोकन 325,471 247,436
आउटपुट टोकन 14,867 11,005
रीजनिंग टोकन 217,675 17,597
प्रतिक्रिया समय (औसत) 44.53s 15.28s
प्रतिक्रिया समय (अधिकतम) 216.69s 83.60s
प्रतिक्रिया समय (कुल) 1024.25s 351.49s
पैरामीटर ~1.5T कुल (~150B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#199 SpaceXAI: Grok 4.3

medium
लागत
$0.009
समय
19.0s
टोकन
3,661 tok

#195 GLM 5.3

low
लागत
$0.007
समय
28.4s
टोकन
1,599 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

त्वरित तुलना

तुलना जोड़ी बदलें