نیویگیشن
Advertise here

Mercury 2.5 (medium) vs GLM 5.3 (low)

average score تقریباً برابر ہے: 6.8 vs 6.8. Mercury 2.5 (medium) کی benchmark لاگت کم ہے: $0.022 vs $0.257. Mercury 2.5 (medium) تیز ہے: 3.19s vs 13.65s، pass rates 65.2% vs 65.2%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-09-08

موازنہ کیے گئے ماڈلز

درجہ
#157
کل آؤٹ پٹ ٹوکنز
120,129
ردِعمل کا وقت (اوسط)
3.19s
کل لاگت
$0.022
درجہ
#155
کل آؤٹ پٹ ٹوکنز
24,808
ردِعمل کا وقت (اوسط)
13.65s
کل لاگت
$0.257
تجویز کردہ ماڈل Mercury 2.5 (medium)

It has the best score here (6.8), while costing about 11.8x less than GLM 5.3 (low).

تفصیلی موازنہ

میٹرک Mercury 2.5 Mercury 2.5 medium اجرا: 2026-09-08 GLM 5.3 GLM 5.3 low اجرا: 2026-08-20
اسکور 6.8 6.8
درجہ #157 #155
اعتماد پذیری 9.8 10.0
تسلسل 8.6 8.5
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.2% 65.2%
غیر مستحکم ٹیسٹ 4 4
کل رنز 66 66
فی نتیجہ لاگت 0.181 2.135
کل لاگت $0.022 $0.257
ان پٹ قیمت $0.040 / 1M $1.400 / 1M
آؤٹ پٹ قیمت $0.150 / 1M $4.400 / 1M
کل ان پٹ ٹوکنز 91,402 104,989
آؤٹ پٹ ٹوکنز 3,138 8,532
ریزننگ ٹوکنز 116,991 16,276
ردِعمل کا وقت (اوسط) 3.19s 13.65s
ردِعمل کا وقت (زیادہ سے زیادہ) 9.87s 83.60s
ردِعمل کا وقت (کل) 70.18s 300.22s
پیرامیٹرز ~100B 744B کل (40B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#157 Mercury 2.5

medium
لاگت
$0.001
وقت
3.8s
ٹوکنز
3,386 tok

#155 GLM 5.3

low
لاگت
$0.007
وقت
28.4s
ٹوکنز
1,599 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mercury 2.5 5.0 5.1 44.5% 2 3.70s 7,807 488 21,857
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں