नेविगेशन
Advertise here

Granite 4.2 8B (low) vs Mercury 2.5 (low)

average score लगभग बराबर है: 5.1 vs 5.1. Mercury 2.5 (low) की benchmark लागत कम है: $0.011 vs $0.012. Mercury 2.5 (low) तेज है: 1.35s vs 54.36s, pass rates 31.8% vs 39.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-08

तुलना किए गए मॉडल

रैंक
#263
कुल आउटपुट टोकन
27,928
प्रतिक्रिया समय (औसत)
54.36s
कुल लागत
$0.012
रैंक
#265
कुल आउटपुट टोकन
33,719
प्रतिक्रिया समय (औसत)
1.35s
कुल लागत
$0.011
अनुशंसित मॉडल Mercury 2.5 (low)

It has the best score here (5.1), while responding about 40.2x faster than Granite 4.2 8B (low).

विस्तृत तुलना

मेट्रिक Granite 4.2 8B Granite 4.2 8B low रिलीज़: 2026-09-02 Mercury 2.5 Mercury 2.5 low रिलीज़: 2026-09-08
स्कोर 5.1 5.1
रैंक #263 #265
विश्वसनीयता 9.0 9.8
संगति 10.0 8.1
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 31.8% 39.4%
अस्थिर टेस्ट 0 5
कुल रन 66 66
प्रति परिणाम लागत 0.167 0.177
कुल लागत $0.012 $0.011
इनपुट कीमत $0.100 / 1M $0.040 / 1M
आउटपुट कीमत $0.150 / 1M $0.150 / 1M
कुल इनपुट टोकन 74,721 138,020
आउटपुट टोकन 9,205 6,083
रीजनिंग टोकन 18,723 27,636
प्रतिक्रिया समय (औसत) 54.36s 1.35s
प्रतिक्रिया समय (अधिकतम) 566.80s 7.48s
प्रतिक्रिया समय (कुल) 1195.97s 29.74s
पैरामीटर 8B ~100B
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#263 IBM: Granite 4.2 8B

low
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#265 Mercury 2.5

low
लागत
$0.001
समय
2.4s
टोकन
1,236 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.2 8B 5.5 10.0 33.3% 0 13.01s 8,439 2,469 2,984
Mercury 2.5 5.5 10.0 33.3% 0 972ms 7,909 521 2,269

त्वरित तुलना

तुलना जोड़ी बदलें