नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

IBM: Granite 4.1 8B vs MiniMax: MiniMax M2.5

सारांश

Granite 4.1 8B vs MiniMax M2.5 benchmark तुलना: MiniMax M2.5 average score में आगे है: 4.7 vs 4.0. Granite 4.1 8B की benchmark लागत कम है: $0.003 vs $0.303. Granite 4.1 8B तेज है: 728ms vs 65.37s, pass rates 9.5% vs 46.0%.

अनुशंसित मॉडल: Granite 4.1 8B - Its score stays close to the best score here (4.0 vs 4.7), while costing about 116.1x less than MiniMax M2.5.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-12

मेट्रिक Granite 4.1 8B Granite 4.1 8B none रिलीज़: 2026-05-01 MiniMax M2.5 MiniMax M2.5 medium रिलीज़: 2026-02-12
स्कोर 4.0 4.7
रैंक #163 #151
विश्वसनीयता 10.0 10.0
संगति 10.0 6.5
सही परीक्षण
प्रति प्रयास पास दर 9.5% 46.0%
अस्थिर टेस्ट 0 9
कुल रन 63 63
प्रति परिणाम लागत 0.131 7.900
कुल लागत $0.003 $0.303
इनपुट कीमत $0.050 / 1M $0.150 / 1M
आउटपुट कीमत $0.100 / 1M $0.900 / 1M
कुल इनपुट टोकन 46,285 43,706
आउटपुट टोकन 2,911 109,495
रीजनिंग टोकन 0 330,814
प्रतिक्रिया समय (औसत) 728ms 65.37s
प्रतिक्रिया समय (अधिकतम) 2.17s 251.36s
प्रतिक्रिया समय (कुल) 15.29s 849.76s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#163 IBM: Granite 4.1 8B

none
Cost
$0.001
Time
3.2s
Tokens
491 tok

#151 MiniMax M2.5

medium
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 4.9 10.0 25.0% 0 844ms 645 903 0
MiniMax M2.5 7.9 6.3 83.3% 2 20.82s 612 286 45,344
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 4.5 10.0 0.0% 0 775ms 8,344 525 0
MiniMax M2.5 3.4 9.1 0.0% 0 188.58s 6,076 357 106,177
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 3.0 10.0 0.0% 0 1.88s 19,089 396 0
MiniMax M2.5 4.5 2.1 66.7% 1 60.39s 21,104 740 9,713
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 3.0 10.0 0.0% 0 575ms 7,617 195 0
MiniMax M2.5 4.6 1.7 66.7% 2 7.48s 6,584 266 3,835
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 3.0 10.0 0.0% 0 357ms 768 24 0
MiniMax M2.5 2.9 4.4 22.2% 2 237.27s 308 105,047 133,487
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 4.0 10.0 0.0% 0 499ms 528 115 0
MiniMax M2.5 3.8 2.5 33.3% 1 6.63s 492 25 1,686
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 3.6 9.9 0.0% 0 344ms 687 66 0
MiniMax M2.5 7.5 10.0 50.0% 0 621ms 699 156 1,495
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 3.2 10.0 0.0% 0 608ms 672 432 0
MiniMax M2.5 5.3 7.2 44.4% 1 11.21s 495 1,069 9,605
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 10.0 10.0 100.0% 0 2.17s 7,719 243 0
MiniMax M2.5 10.0 10.0 100.0% 0 15.35s 7,123 269 937
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 3.0 10.0 0.0% 0 306ms 216 12 0
MiniMax M2.5 3.0 10.0 0.0% 0 80.79s 213 1,280 18,535

त्वरित तुलना

तुलना जोड़ी बदलें