نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.7 Plus vs Xiaomi: MiMo-V2.5

خلاصہ

Qwen3.7 Plus vs MiMo-V2.5 benchmark موازنہ: Qwen3.7 Plus average score میں آگے ہے: 7.2 vs 6.7. Qwen3.7 Plus کی benchmark لاگت کم ہے: $0.023 vs $0.063. Qwen3.7 Plus تیز ہے: 2.85s vs 27.11s، pass rates 47.6% vs 69.8%.

تجویز کردہ ماڈل: Qwen3.7 Plus - It has the best score here (7.2), while costing about 2.8x less than MiMo-V2.5.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-18

میٹرک Qwen3.7 Plus Qwen3.7 Plus none اجرا: 2026-06-03 MiMo-V2.5 MiMo-V2.5 medium اجرا: 2026-04-22
اسکور 7.2 6.7
درجہ #60 #76
اعتماد پذیری 10.0 10.0
تسلسل 10.0 8.1
درست ٹیسٹس
فی کوشش کامیابی کی شرح 47.6% 69.8%
غیر مستحکم ٹیسٹ 0 5
کل رنز 63 63
فی نتیجہ لاگت 0.276 2.966
کل لاگت $0.023 $0.063
ان پٹ قیمت $0.320 / 1M $0.140 / 1M
آؤٹ پٹ قیمت $1.280 / 1M $0.280 / 1M
کل ان پٹ ٹوکنز 42,510 41,838
آؤٹ پٹ ٹوکنز 6,578 2,827
ریزننگ ٹوکنز 0 198,898
ردِعمل کا وقت (اوسط) 2.85s 27.11s
ردِعمل کا وقت (زیادہ سے زیادہ) 29.38s 162.44s
ردِعمل کا وقت (کل) 59.86s 569.38s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 Qwen3.7 Plus

none
لاگت
$0.019
وقت
213.5s
ٹوکنز
11,960 tok

#76 MiMo-V2.5

medium
لاگت
$0.002
وقت
54.8s
ٹوکنز
5,247 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 6.5 10.0 50.0% 0 1.38s 696 349 0
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 621 281 1,739
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 10.0 10.0 100.0% 0 29.38s 14,952 4,505 0
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 15,060 363 7,609
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 10.0 10.0 100.0% 0 1.43s 7,794 243 0
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 7,746 306 5,714
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 3.0 10.0 0.0% 0 868ms 789 18 0
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 735 507 49,478
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 5.3 10.0 0.0% 0 1.33s 522 78 0
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 492 121 418
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 6.3 10.0 50.0% 0 929ms 711 72 0
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 672 88 801
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 7.7 10.0 66.7% 0 1.71s 714 443 0
MiMo-V2.5 8.2 7.2 88.9% 1 20.25s 660 279 33,254
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 10.0 10.0 100.0% 0 3.54s 8,211 222 0
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 8,220 303 2,424
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 3.0 10.0 0.0% 0 1.21s 210 9 0
MiMo-V2.5 3.0 10.0 0.0% 0 51.29s 210 22 15,484

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں