نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MiniMax: MiniMax M3 vs OpenAI: GPT-5.5

خلاصہ

MiniMax M3 vs GPT-5.5 benchmark موازنہ: MiniMax M3 average score میں آگے ہے: 7.1 vs 6.4. MiniMax M3 کی benchmark لاگت کم ہے: $0.131 vs $0.231. GPT-5.5 تیز ہے: 1.89s vs 68.17s، pass rates 65.1% vs 54.0%.

تجویز کردہ ماڈل: GPT-5.5 - Its score stays close to the best score here (6.4 vs 7.1), while responding about 36.1x faster than MiniMax M3.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-04

میٹرک MiniMax M3 MiniMax M3 medium اجرا: 2026-06-01 GPT-5.5 GPT-5.5 none اجرا: 2026-04-24
اسکور 7.1 6.4
درجہ #67 #91
اعتماد پذیری 9.6 10.0
تسلسل 7.9 8.8
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.1% 54.0%
غیر مستحکم ٹیسٹ 5 3
کل رنز 63 63
فی نتیجہ لاگت 1.187 2.302
کل لاگت $0.131 $0.231
ان پٹ قیمت $0.300 / 1M $5.000 / 1M
آؤٹ پٹ قیمت $1.200 / 1M $30.000 / 1M
کل ان پٹ ٹوکنز 46,546 34,212
آؤٹ پٹ ٹوکنز 49,036 1,971
ریزننگ ٹوکنز 92,543 0
ردِعمل کا وقت (اوسط) 68.17s 1.89s
ردِعمل کا وقت (زیادہ سے زیادہ) 431.03s 5.56s
ردِعمل کا وقت (کل) 1363.38s 39.64s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 MiniMax M3

medium
Cost
$0.012
Time
154.4s
Tokens
10,018 tok

#91 GPT-5.5

none
Cost
$0.090
Time
54.3s
Tokens
3,063 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 5.5 3.7 66.7% 3 14.95s 2,526 874 3,414
GPT-5.5 6.9 7.9 66.7% 1 1.31s 606 213 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 6.1 6.5 55.6% 1 144.74s 5,804 6,223 32,667
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 10.0 10.0 100.0% 0 65.30s 14,760 1,306 6,253
GPT-5.5 3.0 10.0 0.0% 0 5.56s 11,019 300 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 10.0 10.0 100.0% 0 14.92s 8,088 514 3,164
GPT-5.5 10.0 10.0 100.0% 0 1.18s 7,140 222 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 5.5 9.3 33.3% 0 233.13s 869 16,254 19,070
GPT-5.5 2.9 7.2 11.1% 1 1.31s 723 52 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 5.1 3.4 33.3% 1 33.25s 954 2,487 2,523
GPT-5.5 10.0 10.0 100.0% 0 3.41s 477 124 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 9.8 10.0 100.0% 0 6.14s 1,623 103 920
GPT-5.5 6.2 5.8 66.7% 1 1.15s 660 81 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 7.9 9.9 66.7% 0 49.91s 2,079 11,946 13,761
GPT-5.5 7.7 10.0 66.7% 0 1.29s 642 252 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 10.0 10.0 100.0% 0 11.91s 9,168 281 555
GPT-5.5 10.0 10.0 100.0% 0 3.90s 5,445 247 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MiniMax M3 3.0 10.0 0.0% 0 100.80s 675 9,048 10,216
GPT-5.5 3.0 10.0 0.0% 0 5.01s 195 18 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں