नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

xAI: Grok 4.20 vs Xiaomi: MiMo-V2-Omni

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-02

मेट्रिक Grok 4.20 Grok 4.20 medium रिलीज़: 2026-03-31 MiMo-V2-Omni MiMo-V2-Omni none रिलीज़: 2026-03-18
स्कोर 7.1 6.4
रैंक #40 #49
संगति 8.2 10.0
सही परीक्षण
प्रति प्रयास पास दर 66.7% 47.1%
अस्थिर टेस्ट 4 0
कुल रन 51 17
प्रति परिणाम लागत 7.358 0.069
कुल लागत $0.663 $0.006
???? ??? $2.000 / 1M $0.400 / 1M
????? ??? $6.000 / 1M $2.000 / 1M
आउटपुट टोकन 1,494 469
रीजनिंग टोकन 97,078 0
प्रतिक्रिया समय (औसत) 9.50s 2.01s
प्रतिक्रिया समय (अधिकतम) 29.87s 6.81s
प्रतिक्रिया समय (कुल) 161.54s 34.09s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 8.2 7.9 83.3% 1 3.36s 280 8,476
MiMo-V2-Omni 4.8 10.0 25.0% 0 1.10s 74 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 10.0 10.0 100.0% 0 17.40s 232 9,556
MiMo-V2-Omni 3.0 10.0 0.0% 0 2.47s 110 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 10.0 10.0 100.0% 0 4.17s 180 5,333
MiMo-V2-Omni 10.0 10.0 100.0% 0 1.69s 83 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 5.3 10.0 33.3% 0 27.03s 375 49,339
MiMo-V2-Omni 5.3 10.0 33.3% 0 1.14s 8 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 5.8 2.8 66.7% 1 7.09s 47 4,252
MiMo-V2-Omni 4.5 10.0 0.0% 0 1.19s 37 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 7.3 5.9 83.3% 1 4.42s 40 5,474
MiMo-V2-Omni 6.5 10.0 50.0% 0 4.18s 22 0
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 6.4 7.7 55.6% 1 3.89s 143 8,028
MiMo-V2-Omni 8.0 10.0 66.7% 0 2.71s 58 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 3.0 10.0 0.0% 0 13.68s 197 6,620
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.76s 77 0

त्वरित तुलना

तुलना जोड़ी बदलें