نیویگیشن
AI BENCHY
موازنہ کریں چارٹس
❤️ Made by XCS
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.3-Codex vs Xiaomi: MiMo-V2-Flash

ماڈل کا نام:

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے : 2026-02-27 15:16

خلاصہ

میٹرک OpenAI: GPT-5.3-Codex medium اجرا: ریلیز کی تاریخ نامعلوم Xiaomi: MiMo-V2-Flash medium اجرا: ریلیز کی تاریخ نامعلوم
درجہ #7 #21
اسکور 7.93 6.00
تسلسل 8.84 8.79
فی نتیجہ لاگت 4.641 0.364
کل لاگت $0.465 $0.030
درست ٹیسٹس
غلط ٹیسٹس 4 6
فی کوشش کامیابی کی شرح 78.6% 64.3%
غیر مستحکم ٹیسٹ 2 2
آؤٹ پٹ ٹوکنز 1,201 11,650
ریزننگ ٹوکنز 30,056 93,283

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex 10.00 10.00 100.0% 0 216 1,421
Xiaomi: MiMo-V2-Flash 9.67 9.99 100.0% 0 1,328 18,739
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex 10.00 10.00 100.0% 0 234 735
Xiaomi: MiMo-V2-Flash 5.50 10.00 50.0% 0 153 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex 4.00 7.21 55.6% 1 64 25,308
Xiaomi: MiMo-V2-Flash 4.00 7.21 55.6% 1 8,363 51,202
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex 9.00 10.00 50.0% 0 93 693
Xiaomi: MiMo-V2-Flash 9.50 9.99 100.0% 0 72 3,504
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex 7.00 7.38 77.8% 1 340 1,407
Xiaomi: MiMo-V2-Flash 1.00 7.14 11.1% 1 1,413 7,123
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex 10.00 10.00 100.0% 0 254 492
Xiaomi: MiMo-V2-Flash 10.00 10.00 100.0% 0 321 12,715

موازنہ کی جوڑی تبدیل کریں