نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.5 vs Xiaomi: MiMo-V2-Flash

خلاصہ

GPT-5.5 vs MiMo-V2-Flash benchmark موازنہ: GPT-5.5 average score میں آگے ہے: 9.3 vs 4.3. MiMo-V2-Flash کی benchmark لاگت کم ہے: $0.025 vs $0.907. MiMo-V2-Flash تیز ہے: 2.76s vs 9.76s، pass rates 85.7% vs 25.4%.

تجویز کردہ ماڈل: GPT-5.5 - It has the strongest score in this comparison (9.3) and the best overall balance of cost and response time across all 2 models.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-02

میٹرک GPT-5.5 GPT-5.5 low اجرا: 2026-04-24 MiMo-V2-Flash MiMo-V2-Flash none اجرا: 2025-12-16
اسکور 9.3 4.3
درجہ #4 #164
اعتماد پذیری 10.0 6.7
تسلسل 10.0 8.5
درست ٹیسٹس
فی کوشش کامیابی کی شرح 85.7% 25.4%
غیر مستحکم ٹیسٹ 0 4
کل رنز 63 63
فی نتیجہ لاگت 5.035 0.584
کل لاگت $0.907 $0.025
ان پٹ قیمت $5.000 / 1M $0.100 / 1M
آؤٹ پٹ قیمت $30.000 / 1M $0.300 / 1M
کل ان پٹ ٹوکنز 34,209 36,851
آؤٹ پٹ ٹوکنز 2,046 68,882
ریزننگ ٹوکنز 22,460 0
ردِعمل کا وقت (اوسط) 9.76s 2.76s
ردِعمل کا وقت (زیادہ سے زیادہ) 56.19s 19.68s
ردِعمل کا وقت (کل) 204.92s 46.99s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#4 GPT-5.5

low
لاگت
$0.068
وقت
37.0s
ٹوکنز
2,339 tok

#164 MiMo-V2-Flash

none
لاگت
$0.001
وقت
7.7s
ٹوکنز
1,481 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 10.0 10.0 100.0% 0 4.41s 606 238 1,020
MiMo-V2-Flash 3.2 8.0 8.3% 1 1.19s 645 865 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
MiMo-V2-Flash 4.3 7.9 11.1% 1 2.64s 7,442 763 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 10.0 10.0 100.0% 0 9.56s 11,019 303 717
MiMo-V2-Flash 3.0 10.0 0.0% 0 2.87s 15,075 330 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 10.0 10.0 100.0% 0 3.28s 7,140 228 157
MiMo-V2-Flash 2.9 5.8 16.7% 1 19.68s 2,622 161 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 5.3 10.0 33.3% 0 28.05s 723 69 11,609
MiMo-V2-Flash 5.3 7.2 44.4% 1 564ms 753 24 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 10.0 10.0 100.0% 0 5.17s 477 133 245
MiMo-V2-Flash 4.6 10.0 0.0% 0 1.67s 498 104 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 9.9 10.0 100.0% 0 3.74s 660 93 415
MiMo-V2-Flash 6.5 10.0 50.0% 0 857ms 684 69 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 10.0 10.0 100.0% 0 4.74s 642 279 954
MiMo-V2-Flash 5.3 10.0 33.3% 0 1.86s 678 66,282 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 10.0 10.0 100.0% 0 4.96s 5,445 250 101
MiMo-V2-Flash 10.0 10.0 100.0% 0 2.28s 8,238 272 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 3.0 10.0 0.0% 0 10.06s 195 30 840
MiMo-V2-Flash 3.0 10.0 0.0% 0 1.82s 216 12 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں