नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Cobuddy vs IBM: Granite 4.1 8B

सारांश

Cobuddy vs Granite 4.1 8B benchmark तुलना: Cobuddy average score में आगे है: 4.9 vs 4.0. Cobuddy की benchmark लागत कम है: $0.000 vs $0.003. Granite 4.1 8B तेज है: 728ms vs 39.90s, pass rates 47.6% vs 9.5%.

अनुशंसित मॉडल: Granite 4.1 8B - It offers the best overall trade-off: a competitive score (4.0), faster response than Cobuddy, and balanced cost.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-12

मेट्रिक Cobuddy Cobuddy medium रिलीज़: 2026-05-06 Granite 4.1 8B Granite 4.1 8B none रिलीज़: 2026-05-01
स्कोर 4.9 4.0
रैंक #144 #163
विश्वसनीयता 10.0 10.0
संगति 7.5 10.0
सही परीक्षण
प्रति प्रयास पास दर 47.6% 9.5%
अस्थिर टेस्ट 6 0
कुल रन 63 63
प्रति परिणाम लागत 0.000 0.131
कुल लागत $0.000 $0.003
इनपुट कीमत $0.000 / 1M $0.050 / 1M
आउटपुट कीमत $0.000 / 1M $0.100 / 1M
कुल इनपुट टोकन 37,449 46,285
आउटपुट टोकन 1,677 2,911
रीजनिंग टोकन 116,703 0
प्रतिक्रिया समय (औसत) 39.90s 728ms
प्रतिक्रिया समय (अधिकतम) 309.02s 2.17s
प्रतिक्रिया समय (कुल) 797.98s 15.29s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#144 Cobuddy

medium
No showcase result has been generated for this model yet.
Cost
$0.000
Time
-
Tokens
0 tok

#163 IBM: Granite 4.1 8B

none
Cost
$0.001
Time
3.2s
Tokens
491 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 8.7 7.9 91.7% 1 10.00s 453 98 4,666
Granite 4.1 8B 4.9 10.0 25.0% 0 844ms 645 903 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 3.7 6.7 22.2% 1 79.17s 4,726 358 30,138
Granite 4.1 8B 4.5 10.0 0.0% 0 775ms 8,344 525 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 3.0 10.0 0.0% 0 47.38s 18,324 465 7,265
Granite 4.1 8B 3.0 10.0 0.0% 0 1.88s 19,089 396 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 6.3 5.8 66.7% 1 17.36s 8,181 275 5,591
Granite 4.1 8B 3.0 10.0 0.0% 0 575ms 7,617 195 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 2.9 4.4 22.2% 2 128.15s 540 10 49,454
Granite 4.1 8B 3.0 10.0 0.0% 0 357ms 768 24 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 4.2 9.9 0.0% 0 23.23s 498 76 3,782
Granite 4.1 8B 4.0 10.0 0.0% 0 499ms 528 115 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 9.8 10.0 100.0% 0 11.60s 508 64 2,842
Granite 4.1 8B 3.6 9.9 0.0% 0 344ms 687 66 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 3.6 7.2 22.2% 1 12.83s 561 189 5,808
Granite 4.1 8B 3.2 10.0 0.0% 0 608ms 672 432 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 10.0 10.0 100.0% 0 11.19s 3,505 133 294
Granite 4.1 8B 10.0 10.0 100.0% 0 2.17s 7,719 243 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 3.0 10.0 0.0% 0 36.98s 153 9 6,863
Granite 4.1 8B 3.0 10.0 0.0% 0 306ms 216 12 0

त्वरित तुलना

तुलना जोड़ी बदलें