नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

xAI: Grok 4.20 Multi-Agent Beta vs Xiaomi: MiMo-V2-Omni

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-21

मेट्रिक Grok 4.20 Multi-Agent Beta Grok 4.20 Multi-Agent Beta medium रिलीज़: 2026-03-12 MiMo-V2-Omni MiMo-V2-Omni none रिलीज़: 2026-03-18
स्कोर 6.2 6.4
रैंक #47 #43
संगति 7.2 10.0
सही परीक्षण
प्रति प्रयास पास दर 54.9% 47.1%
अस्थिर टेस्ट 6 0
कुल रन 51 17
प्रति परिणाम लागत 82.962 0.069
कुल लागत $4.978 $0.006
???? ??? $2.000 / 1M $0.400 / 1M
????? ??? $6.000 / 1M $2.000 / 1M
आउटपुट टोकन 298,948 469
रीजनिंग टोकन 296,529 0
प्रतिक्रिया समय (औसत) 8.64s 2.01s
प्रतिक्रिया समय (अधिकतम) 35.28s 6.81s
प्रतिक्रिया समय (कुल) 129.64s 34.09s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi-Agent Beta 6.9 5.8 75.0% 2 3.46s 33,706 33,077
MiMo-V2-Omni 4.8 10.0 25.0% 0 1.10s 74 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi-Agent Beta 3.0 10.0 0.0% 0 0ms 0 0
MiMo-V2-Omni 3.0 10.0 0.0% 0 2.47s 110 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi-Agent Beta 10.0 10.0 100.0% 0 5.54s 25,306 25,051
MiMo-V2-Omni 10.0 10.0 100.0% 0 1.69s 83 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi-Agent Beta 2.9 7.2 11.1% 1 24.67s 164,609 163,647
MiMo-V2-Omni 5.3 10.0 33.3% 0 1.14s 8 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi-Agent Beta 5.8 2.8 66.7% 1 6.40s 15,848 15,746
MiMo-V2-Omni 4.5 10.0 0.0% 0 1.19s 37 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi-Agent Beta 8.3 10.0 50.0% 0 4.63s 25,457 25,322
MiMo-V2-Omni 6.5 10.0 50.0% 0 4.18s 22 0
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi-Agent Beta 7.2 5.1 77.8% 2 5.01s 34,022 33,686
MiMo-V2-Omni 8.0 10.0 66.7% 0 2.71s 58 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Grok 4.20 Multi-Agent Beta 3.0 10.0 0.0% 0 0ms 0 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.76s 77 0

त्वरित तुलना

तुलना जोड़ी बदलें