نیویگیشن
Advertise here

Granite 4.2 8B (medium) vs KAT-Coder-Pro V2.5

average score تقریباً برابر ہے: 6.1 vs 6.1. Granite 4.2 8B (medium) کی benchmark لاگت کم ہے: $0.029 vs $0.487. KAT-Coder-Pro V2.5 تیز ہے: 24.96s vs 50.47s، pass rates 37.7% vs 68.1%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-10-01

موازنہ کیے گئے ماڈلز

درجہ
#235
کل آؤٹ پٹ ٹوکنز
50,147
ردِعمل کا وقت (اوسط)
50.47s
کل لاگت
$0.029
درجہ
#236
کل آؤٹ پٹ ٹوکنز
139,572
ردِعمل کا وقت (اوسط)
24.96s
کل لاگت
$0.487
تجویز کردہ ماڈل Granite 4.2 8B (medium)

It has the best score here (6.1), while costing about 17.3x less than KAT-Coder-Pro V2.5.

تفصیلی موازنہ

میٹرک Granite 4.2 8B Granite 4.2 8B medium اجرا: 2026-09-02 KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none اجرا: 2026-07-14
اسکور 6.1 6.1
درجہ #235 #236
اعتماد پذیری 8.9 10.0
تسلسل 9.7 7.1
کوششیں 69/69 69/69
درست ٹیسٹس
فی کوشش کامیابی کی شرح 37.7% 68.1%
غیر مستحکم ٹیسٹ 1 8
کل رنز 69 69
فی نتیجہ لاگت 0.354 4.419
کل لاگت $0.029 $0.487
ان پٹ قیمت $0.060 / 1M $0.740 / 1M
آؤٹ پٹ قیمت $0.250 / 1M $2.960 / 1M
کل ان پٹ ٹوکنز 259,708 98,508
آؤٹ پٹ ٹوکنز 16,567 139,572
ریزننگ ٹوکنز 33,580 0
ردِعمل کا وقت (اوسط) 50.47s 24.96s
ردِعمل کا وقت (زیادہ سے زیادہ) 557.96s 335.41s
ردِعمل کا وقت (کل) 1160.91s 574.12s
پیرامیٹرز 8B ~700B کل (~72B فعال)
دستیابی کھلا ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#235 IBM: Granite 4.2 8B

medium
Provider returned error
لاگت
$0.000
وقت
0.2s
ٹوکنز
0 tok

#236 KAT-Coder-Pro V2.5

none
لاگت
$0.010
وقت
29.0s
ٹوکنز
3,439 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Granite 4.2 8B 5.5 10.0 33.3% 0 12.09s 8,439 2,445 3,900
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں