نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Cobuddy vs IBM: Granite 4.1 8B

خلاصہ

Cobuddy vs Granite 4.1 8B benchmark موازنہ: Cobuddy average score میں آگے ہے: 4.9 vs 4.0. Cobuddy کی benchmark لاگت کم ہے: $0.000 vs $0.003. Granite 4.1 8B تیز ہے: 728ms vs 39.90s، pass rates 47.6% vs 9.5%.

تجویز کردہ ماڈل: Granite 4.1 8B - It offers the best overall trade-off: a competitive score (4.0), faster response than Cobuddy, and balanced cost.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Cobuddy Cobuddy medium اجرا: 2026-05-06 Granite 4.1 8B Granite 4.1 8B none اجرا: 2026-05-01
اسکور 4.9 4.0
درجہ #144 #163
اعتماد پذیری 10.0 10.0
تسلسل 7.5 10.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 47.6% 9.5%
غیر مستحکم ٹیسٹ 6 0
کل رنز 63 63
فی نتیجہ لاگت 0.000 0.131
کل لاگت $0.000 $0.003
ان پٹ قیمت $0.000 / 1M $0.050 / 1M
آؤٹ پٹ قیمت $0.000 / 1M $0.100 / 1M
کل ان پٹ ٹوکنز 37,449 46,285
آؤٹ پٹ ٹوکنز 1,677 2,911
ریزننگ ٹوکنز 116,703 0
ردِعمل کا وقت (اوسط) 39.90s 728ms
ردِعمل کا وقت (زیادہ سے زیادہ) 309.02s 2.17s
ردِعمل کا وقت (کل) 797.98s 15.29s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#144 Cobuddy

medium
No showcase result has been generated for this model yet.
Cost
$0.000
Time
-
Tokens
0 tok

#163 IBM: Granite 4.1 8B

none
Cost
$0.001
Time
3.2s
Tokens
491 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 8.7 7.9 91.7% 1 10.00s 453 98 4,666
Granite 4.1 8B 4.9 10.0 25.0% 0 844ms 645 903 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 3.7 6.7 22.2% 1 79.17s 4,726 358 30,138
Granite 4.1 8B 4.5 10.0 0.0% 0 775ms 8,344 525 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 3.0 10.0 0.0% 0 47.38s 18,324 465 7,265
Granite 4.1 8B 3.0 10.0 0.0% 0 1.88s 19,089 396 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 6.3 5.8 66.7% 1 17.36s 8,181 275 5,591
Granite 4.1 8B 3.0 10.0 0.0% 0 575ms 7,617 195 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 2.9 4.4 22.2% 2 128.15s 540 10 49,454
Granite 4.1 8B 3.0 10.0 0.0% 0 357ms 768 24 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 4.2 9.9 0.0% 0 23.23s 498 76 3,782
Granite 4.1 8B 4.0 10.0 0.0% 0 499ms 528 115 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 9.8 10.0 100.0% 0 11.60s 508 64 2,842
Granite 4.1 8B 3.6 9.9 0.0% 0 344ms 687 66 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 3.6 7.2 22.2% 1 12.83s 561 189 5,808
Granite 4.1 8B 3.2 10.0 0.0% 0 608ms 672 432 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 10.0 10.0 100.0% 0 11.19s 3,505 133 294
Granite 4.1 8B 10.0 10.0 100.0% 0 2.17s 7,719 243 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 3.0 10.0 0.0% 0 36.98s 153 9 6,863
Granite 4.1 8B 3.0 10.0 0.0% 0 306ms 216 12 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں