نیویگیشن
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.4 vs Xiaomi: MiMo-V2-Omni

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-04-02

میٹرک GPT-5.4 GPT-5.4 medium اجرا: 2026-03-05 MiMo-V2-Omni MiMo-V2-Omni none اجرا: 2026-03-18
اسکور 8.1 6.4
درجہ #18 #49
تسلسل 8.6 10.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 78.4% 47.1%
غیر مستحکم ٹیسٹ 3 0
کل رنز 51 17
فی نتیجہ لاگت 6.613 0.069
کل لاگت $0.794 $0.006
?? ?? ???? $2.500 / 1M $0.400 / 1M
??? ?? ???? $15.000 / 1M $2.000 / 1M
آؤٹ پٹ ٹوکنز 1,780 469
ریزننگ ٹوکنز 46,687 0
ردِعمل کا وقت (اوسط) 18.95s 2.01s
ردِعمل کا وقت (زیادہ سے زیادہ) 100.41s 6.81s
ردِعمل کا وقت (کل) 322.23s 34.09s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 8.3 10.0 75.0% 0 4.11s 240 1,511
MiMo-V2-Omni 4.8 10.0 25.0% 0 1.10s 74 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
MiMo-V2-Omni 3.0 10.0 0.0% 0 2.47s 110 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 10.0 10.0 100.0% 0 5.32s 234 804
MiMo-V2-Omni 10.0 10.0 100.0% 0 1.69s 83 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 5.3 7.2 44.4% 1 74.27s 61 34,748
MiMo-V2-Omni 5.3 10.0 33.3% 0 1.14s 8 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 4.7 3.1 33.3% 1 4.92s 145 321
MiMo-V2-Omni 4.5 10.0 0.0% 0 1.19s 37 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
MiMo-V2-Omni 6.5 10.0 50.0% 0 4.18s 22 0
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 8.2 7.2 88.9% 1 9.13s 442 3,832
MiMo-V2-Omni 8.0 10.0 66.7% 0 2.71s 58 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.76s 77 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں