نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Xiaomi: MiMo-V2.5

خلاصہ

DeepSeek V4 Pro vs MiMo-V2.5 benchmark موازنہ: MiMo-V2.5 average score میں آگے ہے: 6.7 vs 6.3. MiMo-V2.5 کی benchmark لاگت کم ہے: $0.063 vs $0.079. MiMo-V2.5 تیز ہے: 27.11s vs 65.21s، pass rates 52.4% vs 69.8%.

تجویز کردہ ماڈل: MiMo-V2.5 - It has the best score here (6.7), while responding about 2.4x faster than DeepSeek V4 Pro.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک DeepSeek V4 Pro DeepSeek V4 Pro high اجرا: 2026-04-24 MiMo-V2.5 MiMo-V2.5 medium اجرا: 2026-04-22
اسکور 6.3 6.7
درجہ #90 #76
اعتماد پذیری 9.0 10.0
تسلسل 7.6 8.1
درست ٹیسٹس
فی کوشش کامیابی کی شرح 52.4% 69.8%
غیر مستحکم ٹیسٹ 6 5
کل رنز 63 63
فی نتیجہ لاگت 2.869 2.966
کل لاگت $0.079 $0.063
ان پٹ قیمت $0.435 / 1M $0.140 / 1M
آؤٹ پٹ قیمت $0.870 / 1M $0.280 / 1M
کل ان پٹ ٹوکنز 32,240 41,838
آؤٹ پٹ ٹوکنز 12,250 2,827
ریزننگ ٹوکنز 72,257 198,898
ردِعمل کا وقت (اوسط) 65.21s 27.11s
ردِعمل کا وقت (زیادہ سے زیادہ) 358.35s 162.44s
ردِعمل کا وقت (کل) 1304.19s 569.38s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#90 DeepSeek V4 Pro

high
Cost
$0.023
Time
257.6s
Tokens
14,870 tok

#76 MiMo-V2.5

medium
Cost
$0.002
Time
54.8s
Tokens
5,247 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 6.4 7.9 58.3% 1 16.53s 448 71 3,617
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 621 281 1,739
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 3.3 6.4 11.1% 1 118.23s 1,966 111 20,940
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 10.0 10.0 100.0% 0 65.02s 14,016 465 5,914
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 15,060 363 7,609
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 7.3 5.9 83.3% 1 23.62s 5,633 229 1,710
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 7,746 306 5,714
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 2.9 7.2 11.1% 1 205.66s 430 10,529 28,089
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 735 507 49,478
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 6.1 3.1 66.7% 1 25.09s 314 76 1,152
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 492 121 418
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 10.0 10.0 100.0% 0 41.16s 627 205 2,416
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 672 88 801
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 5.9 7.2 55.6% 1 34.84s 544 139 4,019
MiMo-V2.5 8.2 7.2 88.9% 1 20.25s 660 279 33,254
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 10.0 10.0 100.0% 0 21.33s 8,079 372 593
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 8,220 303 2,424
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 3.0 10.0 0.0% 0 39.14s 183 53 3,807
MiMo-V2.5 3.0 10.0 0.0% 0 51.29s 210 22 15,484

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں