نیویگیشن
AI BENCHY
Advertise here

Grok 4.3 (medium) vs GLM 5.1 (medium)

average score تقریباً برابر ہے: 7.1 vs 7.1. GLM 5.1 (medium) کی benchmark لاگت کم ہے: $0.535 vs $0.779. GLM 5.1 (medium) تیز ہے: 46.77s vs 47.45s، pass rates 68.2% vs 69.7%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-28

درجہ
#83
کل آؤٹ پٹ ٹوکنز
241,421
ردِعمل کا وقت (اوسط)
47.45s
کل لاگت
$0.779
درجہ
#84
کل آؤٹ پٹ ٹوکنز
152,552
ردِعمل کا وقت (اوسط)
46.77s
کل لاگت
$0.535
تجویز کردہ ماڈل GLM 5.1 (medium)

It has the strongest score in this comparison (7.1) and the best overall balance of cost and response time across all 2 models.

تفصیلی موازنہ

میٹرک Grok 4.3 Grok 4.3 medium اجرا: 2026-05-01 GLM 5.1 GLM 5.1 medium اجرا: 2026-04-07
اسکور 7.1 7.1
درجہ #83 #84
اعتماد پذیری 10.0 8.3
تسلسل 8.6 8.4
درست ٹیسٹس
فی کوشش کامیابی کی شرح 68.2% 69.7%
غیر مستحکم ٹیسٹ 4 4
کل رنز 66 66
فی نتیجہ لاگت 5.990 4.202
کل لاگت $0.779 $0.535
ان پٹ قیمت $1.250 / 1M $0.966 / 1M
آؤٹ پٹ قیمت $2.500 / 1M $3.036 / 1M
کل ان پٹ ٹوکنز 140,031 82,623
آؤٹ پٹ ٹوکنز 13,739 16,089
ریزننگ ٹوکنز 227,682 136,463
ردِعمل کا وقت (اوسط) 47.45s 46.77s
ردِعمل کا وقت (زیادہ سے زیادہ) 216.69s 308.75s
ردِعمل کا وقت (کل) 1043.83s 982.16s

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#83 xAI: Grok 4.3

medium
لاگت
$0.009
وقت
19.0s
ٹوکنز
3,661 tok

#84 GLM 5.1

medium
غلط SVG
لاگت
$0.000
وقت
300.0s
ٹوکنز
0 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں