نیویگیشن
Advertise here

Ember-1 (high) vs Grok 4.3 (medium)

average score تقریباً برابر ہے: 7.1 vs 7.0. Grok 4.3 (medium) کی benchmark لاگت کم ہے: $0.741 vs $1.798. Grok 4.3 (medium) تیز ہے: 44.21s vs 56.77s، pass rates 71.2% vs 66.7%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-09-28

موازنہ کیے گئے ماڈلز

درجہ
#158
کل آؤٹ پٹ ٹوکنز
110,125
ردِعمل کا وقت (اوسط)
56.77s
کل لاگت
$1.798
درجہ
#159
کل آؤٹ پٹ ٹوکنز
225,904
ردِعمل کا وقت (اوسط)
44.21s
کل لاگت
$0.741
تجویز کردہ ماڈل Grok 4.3 (medium)

It has the best score here (7.0), while costing about 2.4x less than Ember-1 (high).

تفصیلی موازنہ

میٹرک Ember-1 Ember-1 high اجرا: 2026-09-28 Grok 4.3 Grok 4.3 medium اجرا: 2026-05-01
اسکور 7.1 7.0
درجہ #158 #159
اعتماد پذیری 8.0 10.0
تسلسل 7.3 8.2
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 71.2% 66.7%
غیر مستحکم ٹیسٹ 7 5
کل رنز 66 66
فی نتیجہ لاگت 14.981 6.168
کل لاگت $1.798 $0.741
ان پٹ قیمت $3.000 / 1M $1.250 / 1M
آؤٹ پٹ قیمت $15.000 / 1M $2.500 / 1M
کل ان پٹ ٹوکنز 48,577 140,244
آؤٹ پٹ ٹوکنز 7,345 13,739
ریزننگ ٹوکنز 102,780 212,165
ردِعمل کا وقت (اوسط) 56.77s 44.21s
ردِعمل کا وقت (زیادہ سے زیادہ) 255.06s 216.69s
ردِعمل کا وقت (کل) 1248.88s 972.64s
پیرامیٹرز ~2.8T کل (~104B فعال) ~1.5T کل (~150B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#158 Ember-1

high
لاگت
$0.038
وقت
55.1s
ٹوکنز
2,671 tok

#159 SpaceXAI: Grok 4.3

medium
لاگت
$0.009
وقت
19.0s
ٹوکنز
3,661 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں