नेविगेशन
AI BENCHY
Advertise here

Granite 4.2 8B (medium) vs Mistral Small 4 (medium)

average score लगभग बराबर है: 5.2 vs 5.1. Granite 4.2 8B (medium) की benchmark लागत कम है: $0.009 vs $0.097. Mistral Small 4 (medium) तेज है: 10.80s vs 45.97s, pass rates 34.9% vs 43.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#243
कुल आउटपुट टोकन
19,330
प्रतिक्रिया समय (औसत)
45.97s
कुल लागत
$0.009
रैंक
#246
कुल आउटपुट टोकन
133,597
प्रतिक्रिया समय (औसत)
10.80s
कुल लागत
$0.097
अनुशंसित मॉडल Mistral Small 4 (medium)

It has the best score here (5.1), while responding about 4.3x faster than Granite 4.2 8B (medium).

विस्तृत तुलना

मेट्रिक Granite 4.2 8B Granite 4.2 8B medium रिलीज़: 2026-09-02 Mistral Small 4 Mistral Small 4 medium रिलीज़: 2026-03-16
स्कोर 5.2 5.1
रैंक #243 #246
विश्वसनीयता 8.7 10.0
संगति 9.6 7.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 34.9% 43.9%
अस्थिर टेस्ट 1 8
कुल रन 66 66
प्रति परिणाम लागत 0.117 1.923
कुल लागत $0.009 $0.097
इनपुट कीमत $0.100 / 1M $0.150 / 1M
आउटपुट कीमत $0.150 / 1M $0.600 / 1M
कुल इनपुट टोकन 52,909 140,559
आउटपुट टोकन 7,058 40,268
रीजनिंग टोकन 12,272 93,329
प्रतिक्रिया समय (औसत) 45.97s 10.80s
प्रतिक्रिया समय (अधिकतम) 557.96s 59.15s
प्रतिक्रिया समय (कुल) 1011.42s 237.60s
पैरामीटर 8B 119B कुल (6B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#243 IBM: Granite 4.2 8B

medium
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#246 Mistral Small 4

medium
लागत
$0.006
समय
47.9s
टोकन
9,857 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.2 8B 5.5 10.0 33.3% 0 12.09s 8,439 2,445 3,900
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715

त्वरित तुलना

तुलना जोड़ी बदलें