نیویگیشن
AI BENCHY
Your ad here

AI BENCHY Compare

xAI: Grok 4.20 Beta vs Xiaomi: MiMo-V2-Pro

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-03-20

میٹرک Grok 4.20 Beta Grok 4.20 Beta medium اجرا: 2026-03-12 MiMo-V2-Pro MiMo-V2-Pro medium اجرا: 2026-03-18
اسکور 7.9 8.0
درجہ #22 #20
تسلسل 9.0 8.5
درست ٹیسٹس
فی کوشش کامیابی کی شرح 72.6% 76.5%
غیر مستحکم ٹیسٹ 2 3
کل رنز 51 45
فی نتیجہ لاگت 5.525 1.110
کل لاگت $0.608 $0.123
?? ?? ???? $2.000 / 1M $1.000 / 1M
??? ?? ???? $6.000 / 1M $3.000 / 1M
آؤٹ پٹ ٹوکنز 1,487 1,875
ریزننگ ٹوکنز 87,922 26,959
ردِعمل کا وقت (اوسط) 8.54s 9.78s
ردِعمل کا وقت (زیادہ سے زیادہ) 24.21s 64.71s
ردِعمل کا وقت (کل) 145.26s 156.45s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 Beta 8.7 7.9 91.7% 1 3.16s 268 7,583
MiMo-V2-Pro 10.0 10.0 100.0% 0 3.06s 223 1,107
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 Beta 10.0 10.0 100.0% 0 20.93s 227 12,212
MiMo-V2-Pro 4.7 1.6 66.7% 1 64.71s 380 14,186
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.01s 180 5,281
MiMo-V2-Pro 7.3 5.8 83.3% 1 17.20s 260 7,484
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 Beta 5.3 10.0 33.3% 0 21.33s 251 40,255
MiMo-V2-Pro 5.3 10.0 33.3% 0 6.00s 155 1,048
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 Beta 10.0 10.0 100.0% 0 5.78s 72 3,440
MiMo-V2-Pro 10.0 10.0 100.0% 0 4.06s 198 424
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 Beta 8.3 10.0 50.0% 0 4.97s 57 7,107
MiMo-V2-Pro 9.9 10.0 100.0% 0 3.36s 83 667
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 Beta 8.2 7.2 88.9% 1 3.85s 249 6,660
MiMo-V2-Pro 7.0 7.2 55.6% 1 4.71s 313 1,179
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Grok 4.20 Beta 3.0 10.0 0.0% 0 12.39s 183 5,384
MiMo-V2-Pro 10.0 10.0 100.0% 0 8.19s 263 864

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں