नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Google: Gemini 3.1 Flash Lite vs Xiaomi: MiMo-V2.5

सारांश

Gemini 3.1 Flash Lite vs MiMo-V2.5 benchmark तुलना: MiMo-V2.5 average score में आगे है: 6.7 vs 6.4. Gemini 3.1 Flash Lite की benchmark लागत कम है: $0.028 vs $0.061. Gemini 3.1 Flash Lite तेज है: 1.89s vs 27.11s, pass rates 61.9% vs 69.8%.

अनुशंसित मॉडल: Gemini 3.1 Flash Lite - Its score stays close to the best score here (6.4 vs 6.7), while costing about 2.2x less than MiMo-V2.5.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-02

मेट्रिक Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low रिलीज़: 2026-05-08 MiMo-V2.5 MiMo-V2.5 medium रिलीज़: 2026-04-22
स्कोर 6.4 6.7
रैंक #88 #79
विश्वसनीयता 10.0 10.0
संगति 9.3 8.1
सही परीक्षण
प्रति प्रयास पास दर 61.9% 69.8%
अस्थिर टेस्ट 2 5
कुल रन 63 63
प्रति परिणाम लागत 0.227 2.966
कुल लागत $0.028 $0.061
इनपुट कीमत $0.250 / 1M $0.105 / 1M
आउटपुट कीमत $1.500 / 1M $0.280 / 1M
कुल इनपुट टोकन 36,892 41,838
आउटपुट टोकन 2,732 2,827
रीजनिंग टोकन 9,260 198,898
प्रतिक्रिया समय (औसत) 1.89s 27.11s
प्रतिक्रिया समय (अधिकतम) 5.66s 162.44s
प्रतिक्रिया समय (कुल) 39.62s 569.38s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#88 Gemini 3.1 Flash Lite

low
लागत
$0.003
समय
4.0s
टोकन
1,479 tok

#79 MiMo-V2.5

medium
लागत
$0.002
समय
54.8s
टोकन
5,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 7.3 6.2 75.0% 2 1.84s 500 1,013 1,548
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 621 281 1,739
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 1.53s 8,132 471 1,072
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 4.48s 12,870 348 975
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 15,060 363 7,609
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.44s 7,453 291 697
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 7,746 306 5,714
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 5.3 10.0 33.3% 0 1.52s 639 15 1,214
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 735 507 49,478
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 1.37s 492 69 438
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 492 121 418
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.52s 619 72 760
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 672 88 801
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.40s 570 210 1,191
MiMo-V2.5 8.2 7.2 88.9% 1 20.25s 660 279 33,254
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 5.66s 5,457 234 945
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 8,220 303 2,424
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 1.46s 160 9 420
MiMo-V2.5 3.0 10.0 0.0% 0 51.29s 210 22 15,484

त्वरित तुलना

तुलना जोड़ी बदलें