नेव्हिगेशन
AI BENCHY
Your ad here

AI BENCHY Compare

xAI: Grok 4.20 Beta vs Xiaomi: MiMo-V2-Pro

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-03-20

मेट्रिक Grok 4.20 Beta Grok 4.20 Beta medium प्रकाशन: 2026-03-12 MiMo-V2-Pro MiMo-V2-Pro medium प्रकाशन: 2026-03-18
स्कोअर 7.9 8.0
क्रमांक #22 #20
सुसंगतता 9.0 8.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 72.6% 76.5%
अस्थिर चाचण्या 2 3
एकूण रन 51 45
प्रति निकाल खर्च 5.525 1.110
एकूण खर्च $0.608 $0.123
???? ??? $2.000 / 1M $1.000 / 1M
????? ??? $6.000 / 1M $3.000 / 1M
आउटपुट टोकन्स 1,487 1,875
रिझनिंग टोकन्स 87,922 26,959
प्रतिसाद वेळ (सरासरी) 8.54s 9.78s
प्रतिसाद वेळ (कमाल) 24.21s 64.71s
प्रतिसाद वेळ (एकूण) 145.26s 156.45s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 Beta 8.7 7.9 91.7% 1 3.16s 268 7,583
MiMo-V2-Pro 10.0 10.0 100.0% 0 3.06s 223 1,107
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 Beta 10.0 10.0 100.0% 0 20.93s 227 12,212
MiMo-V2-Pro 4.7 1.6 66.7% 1 64.71s 380 14,186
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.01s 180 5,281
MiMo-V2-Pro 7.3 5.8 83.3% 1 17.20s 260 7,484
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 Beta 5.3 10.0 33.3% 0 21.33s 251 40,255
MiMo-V2-Pro 5.3 10.0 33.3% 0 6.00s 155 1,048
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 Beta 10.0 10.0 100.0% 0 5.78s 72 3,440
MiMo-V2-Pro 10.0 10.0 100.0% 0 4.06s 198 424
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 Beta 8.3 10.0 50.0% 0 4.97s 57 7,107
MiMo-V2-Pro 9.9 10.0 100.0% 0 3.36s 83 667
Puzzle Solving स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 Beta 8.2 7.2 88.9% 1 3.85s 249 6,660
MiMo-V2-Pro 7.0 7.2 55.6% 1 4.71s 313 1,179
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.20 Beta 3.0 10.0 0.0% 0 12.39s 183 5,384
MiMo-V2-Pro 10.0 10.0 100.0% 0 8.19s 263 864

झटपट तुलना

तुलना जोडी बदला