नेविगेशन
AI BENCHY
Advertise here

Granite 4.2 8B (medium) vs Mistral Small 4

average score लगभग बराबर है: 5.2 vs 5.1. Granite 4.2 8B (medium) की benchmark लागत कम है: $0.009 vs $0.022. Mistral Small 4 तेज है: 1.20s vs 45.97s, pass rates 34.9% vs 25.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#243
कुल आउटपुट टोकन
19,330
प्रतिक्रिया समय (औसत)
45.97s
कुल लागत
$0.009
रैंक
#245
कुल आउटपुट टोकन
9,812
प्रतिक्रिया समय (औसत)
1.20s
कुल लागत
$0.022
अनुशंसित मॉडल Mistral Small 4

It has the best score here (5.1), while responding about 38.3x faster than Granite 4.2 8B (medium).

विस्तृत तुलना

मेट्रिक Granite 4.2 8B Granite 4.2 8B medium रिलीज़: 2026-09-02 Mistral Small 4 Mistral Small 4 none रिलीज़: 2026-03-16
स्कोर 5.2 5.1
रैंक #243 #245
विश्वसनीयता 8.7 10.0
संगति 9.6 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 34.9% 25.8%
अस्थिर टेस्ट 1 1
कुल रन 66 66
प्रति परिणाम लागत 0.117 0.432
कुल लागत $0.009 $0.022
इनपुट कीमत $0.100 / 1M $0.150 / 1M
आउटपुट कीमत $0.150 / 1M $0.600 / 1M
कुल इनपुट टोकन 52,909 104,717
आउटपुट टोकन 7,058 9,812
रीजनिंग टोकन 12,272 0
प्रतिक्रिया समय (औसत) 45.97s 1.20s
प्रतिक्रिया समय (अधिकतम) 557.96s 13.16s
प्रतिक्रिया समय (कुल) 1011.42s 26.41s
पैरामीटर 8B 119B कुल (6B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#243 IBM: Granite 4.2 8B

medium
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#245 Mistral Small 4

none
लागत
$0.002
समय
10.4s
टोकन
2,370 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.2 8B 5.5 10.0 33.3% 0 12.09s 8,439 2,445 3,900
Mistral Small 4 3.7 9.7 0.0% 0 901ms 7,636 619 0

त्वरित तुलना

तुलना जोड़ी बदलें