नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Granite 4.2 8B (low) vs MiMo-V2.5

average score लगभग बराबर है: 5.1 vs 5.1. Granite 4.2 8B (low) की benchmark लागत कम है: $0.012 vs $0.025. MiMo-V2.5 तेज है: 4.68s vs 54.36s, pass rates 31.8% vs 27.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#247
कुल आउटपुट टोकन
27,928
प्रतिक्रिया समय (औसत)
54.36s
कुल लागत
$0.012
रैंक
#249
कुल आउटपुट टोकन
16,464
प्रतिक्रिया समय (औसत)
4.68s
कुल लागत
$0.025
अनुशंसित मॉडल MiMo-V2.5

It has the best score here (5.1), while responding about 11.6x faster than Granite 4.2 8B (low).

विस्तृत तुलना

मेट्रिक Granite 4.2 8B Granite 4.2 8B low रिलीज़: 2026-09-02 MiMo-V2.5 MiMo-V2.5 none रिलीज़: 2026-04-22
स्कोर 5.1 5.1
रैंक #247 #249
विश्वसनीयता 9.0 10.0
संगति 10.0 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 31.8% 27.3%
अस्थिर टेस्ट 0 2
कुल रन 66 66
प्रति परिणाम लागत 0.167 0.769
कुल लागत $0.012 $0.025
इनपुट कीमत $0.100 / 1M $0.140 / 1M
आउटपुट कीमत $0.150 / 1M $0.280 / 1M
कुल इनपुट टोकन 74,721 141,052
आउटपुट टोकन 9,205 16,464
रीजनिंग टोकन 18,723 0
प्रतिक्रिया समय (औसत) 54.36s 4.68s
प्रतिक्रिया समय (अधिकतम) 566.80s 55.36s
प्रतिक्रिया समय (कुल) 1195.97s 103.02s
पैरामीटर 8B 310B कुल (15B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#247 IBM: Granite 4.2 8B

low
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#249 MiMo-V2.5

none
लागत
$0.007
समय
267.4s
टोकन
25,283 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.2 8B 5.5 10.0 33.3% 0 13.01s 8,439 2,469 2,984
MiMo-V2.5 5.5 10.0 33.3% 0 3.24s 7,440 696 0

त्वरित तुलना

तुलना जोड़ी बदलें