نیویگیشن
Advertise here

Ember-1 (low) vs GPT-5.4 Mini (medium)

average score تقریباً برابر ہے: 7.5 vs 7.5. Ember-1 (low) کی benchmark لاگت کم ہے: $0.662 vs $0.786. GPT-5.4 Mini (medium) تیز ہے: 26.72s vs 30.98s، pass rates 66.7% vs 68.2%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-09-28

موازنہ کیے گئے ماڈلز

درجہ
#120
کل آؤٹ پٹ ٹوکنز
37,467
ردِعمل کا وقت (اوسط)
30.98s
کل لاگت
$0.662
درجہ
#126
کل آؤٹ پٹ ٹوکنز
158,344
ردِعمل کا وقت (اوسط)
26.72s
کل لاگت
$0.786
تجویز کردہ ماڈل GPT-5.4 Mini (medium)

It has the strongest score in this comparison (7.5) and the best overall balance of cost and response time across all 2 models.

تفصیلی موازنہ

میٹرک Ember-1 Ember-1 low اجرا: 2026-09-28 GPT-5.4 Mini GPT-5.4 Mini medium اجرا: 2026-03-17
اسکور 7.5 7.5
درجہ #120 #126
اعتماد پذیری 8.1 10.0
تسلسل 8.5 8.1
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 66.7% 68.2%
غیر مستحکم ٹیسٹ 4 5
کل رنز 66 66
فی نتیجہ لاگت 5.085 6.546
کل لاگت $0.662 $0.786
ان پٹ قیمت $3.000 / 1M $0.750 / 1M
آؤٹ پٹ قیمت $15.000 / 1M $4.500 / 1M
کل ان پٹ ٹوکنز 33,011 97,164
آؤٹ پٹ ٹوکنز 4,780 6,211
ریزننگ ٹوکنز 32,687 152,133
ردِعمل کا وقت (اوسط) 30.98s 26.72s
ردِعمل کا وقت (زیادہ سے زیادہ) 93.10s 138.75s
ردِعمل کا وقت (کل) 681.50s 587.90s
پیرامیٹرز ~2.8T کل (~104B فعال) ~400B کل (~17B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 Ember-1

low
لاگت
$0.016
وقت
24.2s
ٹوکنز
1,165 tok

#126 GPT-5.4 Mini

medium
لاگت
$0.056
وقت
95.5s
ٹوکنز
12,464 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Ember-1 10.0 10.0 100.0% 0 37.91s 8,097 2,518 13,142
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں