नेविगेशन
Advertise here

Granite 4.2 8B (medium) vs KAT-Coder-Pro V2.5

average score लगभग बराबर है: 6.1 vs 6.1. Granite 4.2 8B (medium) की benchmark लागत कम है: $0.029 vs $0.487. KAT-Coder-Pro V2.5 तेज है: 24.96s vs 50.47s, pass rates 37.7% vs 68.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#235
कुल आउटपुट टोकन
50,147
प्रतिक्रिया समय (औसत)
50.47s
कुल लागत
$0.029
रैंक
#236
कुल आउटपुट टोकन
139,572
प्रतिक्रिया समय (औसत)
24.96s
कुल लागत
$0.487
अनुशंसित मॉडल Granite 4.2 8B (medium)

It has the best score here (6.1), while costing about 17.3x less than KAT-Coder-Pro V2.5.

विस्तृत तुलना

मेट्रिक Granite 4.2 8B Granite 4.2 8B medium रिलीज़: 2026-09-02 KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none रिलीज़: 2026-07-14
स्कोर 6.1 6.1
रैंक #235 #236
विश्वसनीयता 8.9 10.0
संगति 9.7 7.1
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 37.7% 68.1%
अस्थिर टेस्ट 1 8
कुल रन 69 69
प्रति परिणाम लागत 0.354 4.419
कुल लागत $0.029 $0.487
इनपुट कीमत $0.060 / 1M $0.740 / 1M
आउटपुट कीमत $0.250 / 1M $2.960 / 1M
कुल इनपुट टोकन 259,708 98,508
आउटपुट टोकन 16,567 139,572
रीजनिंग टोकन 33,580 0
प्रतिक्रिया समय (औसत) 50.47s 24.96s
प्रतिक्रिया समय (अधिकतम) 557.96s 335.41s
प्रतिक्रिया समय (कुल) 1160.91s 574.12s
पैरामीटर 8B ~700B कुल (~72B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#235 IBM: Granite 4.2 8B

medium
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#236 KAT-Coder-Pro V2.5

none
लागत
$0.010
समय
29.0s
टोकन
3,439 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.2 8B 5.5 10.0 33.3% 0 12.09s 8,439 2,445 3,900
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0

त्वरित तुलना

तुलना जोड़ी बदलें