نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MiniMax: MiniMax M3 vs xAI: Grok Build 0.1

خلاصہ

MiniMax M3 vs Grok Build 0.1 benchmark موازنہ: average score تقریباً برابر ہے: 7.6 vs 7.6. MiniMax M3 کی benchmark لاگت کم ہے: $0.131 vs $0.927. Grok Build 0.1 تیز ہے: 49.90s vs 68.17s، pass rates 65.1% vs 61.9%.

تجویز کردہ ماڈل: MiniMax M3 - It has the best score here (7.6), while costing about 7.1x less than Grok Build 0.1.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-02

میٹرک MiniMax M3 MiniMax M3 medium اجرا: 2026-06-01 Grok Build 0.1 Grok Build 0.1 medium اجرا: 2026-05-21
اسکور 7.6 7.6
درجہ #42 #44
اعتماد پذیری 9.6 10.0
تسلسل 7.9 9.9
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.1% 61.9%
غیر مستحکم ٹیسٹ 5 0
کل رنز 63 63
فی نتیجہ لاگت 1.187 7.124
کل لاگت $0.131 $0.927
ان پٹ قیمت $0.300 / 1M $1.000 / 1M
آؤٹ پٹ قیمت $1.200 / 1M $2.000 / 1M
کل ان پٹ ٹوکنز 46,546 44,418
آؤٹ پٹ ٹوکنز 49,036 2,782
ریزننگ ٹوکنز 92,543 438,018
ردِعمل کا وقت (اوسط) 68.17s 49.90s
ردِعمل کا وقت (زیادہ سے زیادہ) 431.03s 252.69s
ردِعمل کا وقت (کل) 1363.38s 1047.92s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 MiniMax M3

medium
لاگت
$0.012
وقت
154.4s
ٹوکنز
10,018 tok

#44 xAI: Grok Build 0.1

medium
لاگت
$0.028
وقت
81.3s
ٹوکنز
14,009 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 5.5 3.7 66.7% 3 14.95s 2,526 874 3,414
Grok Build 0.1 8.3 10.0 75.0% 0 7.43s 2,010 220 12,162
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 6.1 6.5 55.6% 1 144.74s 5,804 6,223 32,667
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 10.0 10.0 100.0% 0 65.30s 14,760 1,306 6,253
Grok Build 0.1 10.0 10.0 100.0% 0 32.81s 12,909 231 16,917
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 10.0 10.0 100.0% 0 14.92s 8,088 514 3,164
Grok Build 0.1 10.0 10.0 100.0% 0 10.72s 7,761 180 8,876
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 5.5 9.3 33.3% 0 233.13s 869 16,254 19,070
Grok Build 0.1 5.3 10.0 33.3% 0 158.00s 1,764 492 175,294
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 5.1 3.4 33.3% 1 33.25s 954 2,487 2,523
Grok Build 0.1 4.4 9.9 0.0% 0 18.41s 825 76 6,345
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 9.8 10.0 100.0% 0 6.14s 1,623 103 920
Grok Build 0.1 9.8 10.0 100.0% 0 12.36s 1,362 57 9,599
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 7.9 9.9 66.7% 0 49.91s 2,079 11,946 13,761
Grok Build 0.1 7.7 10.0 66.7% 0 18.26s 1,689 195 20,841
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 10.0 10.0 100.0% 0 11.91s 9,168 281 555
Grok Build 0.1 10.0 10.0 100.0% 0 13.12s 7,263 180 4,969
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 3.0 10.0 0.0% 0 100.80s 675 9,048 10,216
Grok Build 0.1 3.0 10.0 0.0% 0 53.51s 531 13 21,563

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں