نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

xAI: Grok 4.20 vs Z.ai: GLM 5.1

خلاصہ

Grok 4.20 vs GLM 5.1 benchmark موازنہ: Grok 4.20 average score میں آگے ہے: 7.3 vs 7.1. GLM 5.1 کی benchmark لاگت کم ہے: $0.292 vs $0.609. Grok 4.20 تیز ہے: 27.68s vs 33.67s، pass rates 63.5% vs 68.3%.

تجویز کردہ ماڈل: GLM 5.1 - Its score stays close to the best score here (7.1 vs 7.3), while costing about 2.1x less than Grok 4.20.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-18

میٹرک Grok 4.20 Grok 4.20 medium اجرا: 2026-03-31 GLM 5.1 GLM 5.1 medium اجرا: 2026-04-07
اسکور 7.3 7.1
درجہ #53 #64
اعتماد پذیری 10.0 6.7
تسلسل 8.8 8.3
درست ٹیسٹس
فی کوشش کامیابی کی شرح 63.5% 68.3%
غیر مستحکم ٹیسٹ 3 4
کل رنز 63 63
فی نتیجہ لاگت 8.309 2.496
کل لاگت $0.609 $0.292
ان پٹ قیمت $1.250 / 1M $0.980 / 1M
آؤٹ پٹ قیمت $2.500 / 1M $3.080 / 1M
کل ان پٹ ٹوکنز 44,433 32,995
آؤٹ پٹ ٹوکنز 1,819 11,655
ریزننگ ٹوکنز 219,524 75,421
ردِعمل کا وقت (اوسط) 27.68s 33.67s
ردِعمل کا وقت (زیادہ سے زیادہ) 199.66s 172.60s
ردِعمل کا وقت (کل) 581.26s 673.41s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#53 xAI: Grok 4.20

medium
لاگت
$0.041
وقت
110.3s
ٹوکنز
16,336 tok

#64 GLM 5.1

medium
غلط SVG
لاگت
$0.000
وقت
300.0s
ٹوکنز
0 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 8.2 7.9 83.3% 1 3.95s 2,010 287 8,312
GLM 5.1 10.0 10.0 100.0% 0 8.31s 555 401 5,122
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 10.0 10.0 100.0% 0 17.40s 12,909 232 9,556
GLM 5.1 9.5 10.0 100.0% 0 43.11s 17,298 327 4,206
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 10.0 10.0 100.0% 0 4.17s 7,761 180 5,333
GLM 5.1 10.0 10.0 100.0% 0 9.33s 7,107 991 4,552
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 5.3 10.0 33.3% 0 27.03s 1,764 375 49,339
GLM 5.1 5.3 10.0 33.3% 0 29.77s 489 969 11,314
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 3.9 2.6 33.3% 1 24.48s 825 65 6,440
GLM 5.1 10.0 10.0 100.0% 0 20.95s 477 2,875 2,875
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 9.8 10.0 100.0% 0 4.26s 1,362 57 6,419
GLM 5.1 6.4 5.8 66.7% 1 7.47s 634 204 1,617
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 7.7 10.0 66.7% 0 6.22s 1,689 149 7,913
GLM 5.1 8.2 7.2 88.9% 1 31.64s 609 935 5,730
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 3.0 10.0 0.0% 0 13.68s 7,275 197 6,620
GLM 5.1 3.0 10.0 0.0% 0 0ms 0 0 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 3.0 10.0 0.0% 0 63.48s 531 9 16,442
GLM 5.1 3.0 10.0 0.0% 0 29.40s 124 82 2,179

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں