نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.5 vs Xiaomi: MiMo-V2.5

خلاصہ

GPT-5.5 vs MiMo-V2.5 benchmark موازنہ: MiMo-V2.5 average score میں آگے ہے: 6.7 vs 6.3. MiMo-V2.5 کی benchmark لاگت کم ہے: $0.063 vs $0.231. GPT-5.5 تیز ہے: 1.89s vs 27.11s، pass rates 54.0% vs 69.8%.

تجویز کردہ ماڈل: MiMo-V2.5 - It has the best score here (6.7), while costing about 3.7x less than GPT-5.5.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-18

میٹرک GPT-5.5 GPT-5.5 none اجرا: 2026-04-24 MiMo-V2.5 MiMo-V2.5 medium اجرا: 2026-04-22
اسکور 6.3 6.7
درجہ #90 #76
اعتماد پذیری 10.0 10.0
تسلسل 8.8 8.1
درست ٹیسٹس
فی کوشش کامیابی کی شرح 54.0% 69.8%
غیر مستحکم ٹیسٹ 3 5
کل رنز 63 63
فی نتیجہ لاگت 2.302 2.966
کل لاگت $0.231 $0.063
ان پٹ قیمت $5.000 / 1M $0.140 / 1M
آؤٹ پٹ قیمت $30.000 / 1M $0.280 / 1M
کل ان پٹ ٹوکنز 34,212 41,838
آؤٹ پٹ ٹوکنز 1,971 2,827
ریزننگ ٹوکنز 0 198,898
ردِعمل کا وقت (اوسط) 1.89s 27.11s
ردِعمل کا وقت (زیادہ سے زیادہ) 5.56s 162.44s
ردِعمل کا وقت (کل) 39.64s 569.38s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#90 GPT-5.5

none
لاگت
$0.090
وقت
54.3s
ٹوکنز
3,063 tok

#76 MiMo-V2.5

medium
لاگت
$0.002
وقت
54.8s
ٹوکنز
5,247 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 6.9 7.9 66.7% 1 1.31s 606 213 0
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 621 281 1,739
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 3.0 10.0 0.0% 0 5.56s 11,019 300 0
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 15,060 363 7,609
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 10.0 10.0 100.0% 0 1.18s 7,140 222 0
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 7,746 306 5,714
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 2.9 7.2 11.1% 1 1.31s 723 52 0
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 735 507 49,478
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 10.0 10.0 100.0% 0 3.41s 477 124 0
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 492 121 418
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 6.2 5.8 66.7% 1 1.15s 660 81 0
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 672 88 801
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 7.7 10.0 66.7% 0 1.29s 642 252 0
MiMo-V2.5 8.2 7.2 88.9% 1 20.25s 660 279 33,254
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 10.0 10.0 100.0% 0 3.90s 5,445 247 0
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 8,220 303 2,424
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 3.0 10.0 0.0% 0 5.01s 195 18 0
MiMo-V2.5 3.0 10.0 0.0% 0 51.29s 210 22 15,484

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں