नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Google: Gemma 4 31B vs Xiaomi: MiMo-V2.5

सारांश

Gemma 4 31B vs MiMo-V2.5 benchmark तुलना: MiMo-V2.5 average score में आगे है: 6.7 vs 6.1. Gemma 4 31B की benchmark लागत कम है: $0.004 vs $0.063. Gemma 4 31B तेज है: 4.05s vs 27.11s, pass rates 47.6% vs 69.8%.

अनुशंसित मॉडल: Gemma 4 31B - Its score stays close to the best score here (6.1 vs 6.7), while costing about 20.8x less than MiMo-V2.5.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-18

मेट्रिक Gemma 4 31B Gemma 4 31B none रिलीज़: 2026-04-02 निःशुल्क उपलब्ध MiMo-V2.5 MiMo-V2.5 medium रिलीज़: 2026-04-22
स्कोर 6.1 6.7
रैंक #98 #76
विश्वसनीयता 10.0 10.0
संगति 10.0 8.1
सही परीक्षण
प्रति प्रयास पास दर 47.6% 69.8%
अस्थिर टेस्ट 0 5
कुल रन 63 63
प्रति परिणाम लागत 0.034 2.966
कुल लागत $0.004 $0.063
इनपुट कीमत $0.120 / 1M $0.140 / 1M
आउटपुट कीमत $0.350 / 1M $0.280 / 1M
कुल इनपुट टोकन 20,911 41,838
आउटपुट टोकन 1,407 2,827
रीजनिंग टोकन 0 198,898
प्रतिक्रिया समय (औसत) 4.05s 27.11s
प्रतिक्रिया समय (अधिकतम) 26.13s 162.44s
प्रतिक्रिया समय (कुल) 76.87s 569.38s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 Gemma 4 31B

none
लागत
$0.001
समय
12.8s
टोकन
795 tok

#76 MiMo-V2.5

medium
लागत
$0.002
समय
54.8s
टोकन
5,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 6.5 10.0 50.0% 0 1.85s 852 45 0
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 621 281 1,739
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 15,060 363 7,609
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 10.0 10.0 100.0% 0 2.25s 8,352 285 0
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 7,746 306 5,714
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 7.7 10.0 66.7% 0 3.22s 903 27 0
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 735 507 49,478
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 10.0 10.0 100.0% 0 2.09s 576 117 0
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 492 121 418
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 6.5 10.0 50.0% 0 2.84s 795 78 0
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 672 88 801
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 6.5 10.0 33.3% 0 4.23s 828 108 0
MiMo-V2.5 8.2 7.2 88.9% 1 20.25s 660 279 33,254
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 8,220 303 2,424
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 3.0 10.0 0.0% 0 1.25s 224 12 0
MiMo-V2.5 3.0 10.0 0.0% 0 51.29s 210 22 15,484

त्वरित तुलना

तुलना जोड़ी बदलें