नेविगेशन
AI BENCHY
Advertise here

Granite 4.2 8B (low) vs Mistral Small 4

average score लगभग बराबर है: 5.1 vs 5.1. Granite 4.2 8B (low) की benchmark लागत कम है: $0.012 vs $0.022. Mistral Small 4 तेज है: 1.20s vs 54.36s, pass rates 31.8% vs 25.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#247
कुल आउटपुट टोकन
27,928
प्रतिक्रिया समय (औसत)
54.36s
कुल लागत
$0.012
रैंक
#245
कुल आउटपुट टोकन
9,812
प्रतिक्रिया समय (औसत)
1.20s
कुल लागत
$0.022
अनुशंसित मॉडल Mistral Small 4

It has the best score here (5.1), while responding about 45.3x faster than Granite 4.2 8B (low).

विस्तृत तुलना

मेट्रिक Granite 4.2 8B Granite 4.2 8B low रिलीज़: 2026-09-02 Mistral Small 4 Mistral Small 4 none रिलीज़: 2026-03-16
स्कोर 5.1 5.1
रैंक #247 #245
विश्वसनीयता 9.0 10.0
संगति 10.0 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 31.8% 25.8%
अस्थिर टेस्ट 0 1
कुल रन 66 66
प्रति परिणाम लागत 0.167 0.432
कुल लागत $0.012 $0.022
इनपुट कीमत $0.100 / 1M $0.150 / 1M
आउटपुट कीमत $0.150 / 1M $0.600 / 1M
कुल इनपुट टोकन 74,721 104,717
आउटपुट टोकन 9,205 9,812
रीजनिंग टोकन 18,723 0
प्रतिक्रिया समय (औसत) 54.36s 1.20s
प्रतिक्रिया समय (अधिकतम) 566.80s 13.16s
प्रतिक्रिया समय (कुल) 1195.97s 26.41s
पैरामीटर 8B 119B कुल (6B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#247 IBM: Granite 4.2 8B

low
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#245 Mistral Small 4

none
लागत
$0.002
समय
10.4s
टोकन
2,370 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.2 8B 5.5 10.0 33.3% 0 13.01s 8,439 2,469 2,984
Mistral Small 4 3.7 9.7 0.0% 0 901ms 7,636 619 0

त्वरित तुलना

तुलना जोड़ी बदलें