नेविगेशन
AI BENCHY
Advertise here

Grok 4.3 (medium) vs GLM 5.1 (medium)

average score लगभग बराबर है: 7.1 vs 7.1. GLM 5.1 (medium) की benchmark लागत कम है: $0.535 vs $0.779. GLM 5.1 (medium) तेज है: 46.77s vs 47.45s, pass rates 68.2% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#83
कुल आउटपुट टोकन
241,421
प्रतिक्रिया समय (औसत)
47.45s
कुल लागत
$0.779
रैंक
#84
कुल आउटपुट टोकन
152,552
प्रतिक्रिया समय (औसत)
46.77s
कुल लागत
$0.535
अनुशंसित मॉडल GLM 5.1 (medium)

It has the strongest score in this comparison (7.1) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01 GLM 5.1 GLM 5.1 medium रिलीज़: 2026-04-07
स्कोर 7.1 7.1
रैंक #83 #84
विश्वसनीयता 10.0 8.3
संगति 8.6 8.4
सही परीक्षण
प्रति प्रयास पास दर 68.2% 69.7%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 5.990 4.202
कुल लागत $0.779 $0.535
इनपुट कीमत $1.250 / 1M $0.966 / 1M
आउटपुट कीमत $2.500 / 1M $3.036 / 1M
कुल इनपुट टोकन 140,031 82,623
आउटपुट टोकन 13,739 16,089
रीजनिंग टोकन 227,682 136,463
प्रतिक्रिया समय (औसत) 47.45s 46.77s
प्रतिक्रिया समय (अधिकतम) 216.69s 308.75s
प्रतिक्रिया समय (कुल) 1043.83s 982.16s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#83 xAI: Grok 4.3

medium
लागत
$0.009
समय
19.0s
टोकन
3,661 tok

#84 GLM 5.1

medium
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

त्वरित तुलना

तुलना जोड़ी बदलें