نیویگیشن
AI BENCHY
Advertise here

Grok 4.20 (medium) vs Grok 4.3 (medium)

average score تقریباً برابر ہے: 7.1 vs 7.1. Grok 4.20 (medium) کی benchmark لاگت کم ہے: $0.777 vs $0.779. Grok 4.20 (medium) تیز ہے: 29.47s vs 47.45s، pass rates 63.6% vs 68.2%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-11

درجہ
#101
کل آؤٹ پٹ ٹوکنز
259,340
ردِعمل کا وقت (اوسط)
29.47s
کل لاگت
$0.777
درجہ
#98
کل آؤٹ پٹ ٹوکنز
241,421
ردِعمل کا وقت (اوسط)
47.45s
کل لاگت
$0.779
تجویز کردہ ماڈل Grok 4.20 (medium)

It has the best score here (7.1), while responding about 1.6x faster than Grok 4.3 (medium).

تفصیلی موازنہ

میٹرک Grok 4.20 Grok 4.20 medium اجرا: 2026-03-31 Grok 4.3 Grok 4.3 medium اجرا: 2026-05-01
اسکور 7.1 7.1
درجہ #101 #98
اعتماد پذیری 10.0 10.0
تسلسل 8.5 8.6
بینچ مارک کوریج 22/22 ٹیسٹس · 66/66 کوششیں 22/22 ٹیسٹس · 66/66 کوششیں
درست ٹیسٹس
فی کوشش کامیابی کی شرح 63.6% 68.2%
غیر مستحکم ٹیسٹ 4 4
کل رنز 66 66
فی نتیجہ لاگت 9.709 5.990
کل لاگت $0.777 $0.779
ان پٹ قیمت $1.250 / 1M $1.250 / 1M
آؤٹ پٹ قیمت $2.500 / 1M $2.500 / 1M
کل ان پٹ ٹوکنز 102,791 140,031
آؤٹ پٹ ٹوکنز 5,363 13,739
ریزننگ ٹوکنز 253,977 227,682
ردِعمل کا وقت (اوسط) 29.47s 47.45s
ردِعمل کا وقت (زیادہ سے زیادہ) 199.66s 216.69s
ردِعمل کا وقت (کل) 648.35s 1043.83s

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#101 xAI: Grok 4.20

medium
لاگت
$0.041
وقت
110.3s
ٹوکنز
16,336 tok

#98 xAI: Grok 4.3

medium
لاگت
$0.009
وقت
19.0s
ٹوکنز
3,661 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں