नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

xAI: Grok Build 0.1 vs Xiaomi: MiMo-V2.5

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-05-21

मेट्रिक Grok Build 0.1 Grok Build 0.1 medium रिलीज़: 2026-05-21 MiMo-V2.5 MiMo-V2.5 medium रिलीज़: 2026-04-22
स्कोर 7.8 7.8
रैंक #41 #37
विश्वसनीयता 10.0 10.0
संगति 8.9 8.6
सही परीक्षण
प्रति प्रयास पास दर 71.9% 75.9%
अस्थिर टेस्ट 3 3
कुल रन 57 54
प्रति परिणाम लागत 4.064 2.101
कुल लागत $0.488 $0.253
???? ??? $1.000 / 1M $0.400 / 1M
????? ??? $2.000 / 1M $2.000 / 1M
आउटपुट टोकन 1,947 2,821
रीजनिंग टोकन 223,372 116,207
प्रतिक्रिया समय (औसत) 22.28s 14.40s
प्रतिक्रिया समय (अधिकतम) 88.28s 86.93s
प्रतिक्रिया समय (कुल) 423.30s 259.20s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok Build 0.1 10.0 10.0 100.0% 0 5.46s 195 9,825
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 281 1,739
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok Build 0.1 7.3 3.7 66.7% 1 30.98s 354 17,734
MiMo-V2.5 10.0 10.0 100.0% 0 31.48s 488 14,813
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok Build 0.1 10.0 10.0 100.0% 0 30.81s 231 18,779
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 363 7,609
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok Build 0.1 10.0 10.0 100.0% 0 7.76s 180 10,343
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 306 5,714
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok Build 0.1 5.3 10.0 33.3% 0 77.75s 501 111,807
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 507 49,478
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok Build 0.1 3.8 2.5 33.3% 1 10.14s 78 5,386
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 121 418
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok Build 0.1 9.8 10.0 100.0% 0 9.62s 57 12,436
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 88 801
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok Build 0.1 6.2 7.5 55.6% 1 8.67s 161 15,476
MiMo-V2.5 8.2 7.2 88.9% 1 20.60s 364 33,211
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok Build 0.1 10.0 10.0 100.0% 0 9.40s 180 5,319
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 303 2,424
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok Build 0.1 3.0 10.0 0.0% 0 26.07s 10 16,267
MiMo-V2.5 - - - - - - - -

त्वरित तुलना

तुलना जोड़ी बदलें