نیویگیشن
Advertise here

LongCat 2.0 vs MiMo-V2.5-Pro (medium)

average score تقریباً برابر ہے: 6.4 vs 6.4. LongCat 2.0 کی benchmark لاگت کم ہے: $0.104 vs $0.502. LongCat 2.0 تیز ہے: 8.50s vs 56.72s، pass rates 42.0% vs 63.8%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-10-01

موازنہ کیے گئے ماڈلز

درجہ
#211
کل آؤٹ پٹ ٹوکنز
17,473
ردِعمل کا وقت (اوسط)
8.50s
کل لاگت
$0.104
درجہ
#208
کل آؤٹ پٹ ٹوکنز
225,985
ردِعمل کا وقت (اوسط)
56.72s
کل لاگت
$0.502
تجویز کردہ ماڈل LongCat 2.0

It has the best score here (6.4), while costing about 4.8x less than MiMo-V2.5-Pro (medium).

تفصیلی موازنہ

میٹرک LongCat 2.0 LongCat 2.0 none اجرا: 2026-07-20 MiMo-V2.5-Pro MiMo-V2.5-Pro medium اجرا: 2026-04-22
اسکور 6.4 6.4
درجہ #211 #208
اعتماد پذیری 10.0 10.0
تسلسل 9.0 7.6
کوششیں 69/69 69/69
درست ٹیسٹس
فی کوشش کامیابی کی شرح 42.0% 63.8%
غیر مستحکم ٹیسٹ 3 7
کل رنز 69 69
فی نتیجہ لاگت 1.298 4.559
کل لاگت $0.104 $0.502
ان پٹ قیمت $0.300 / 1M $0.435 / 1M
آؤٹ پٹ قیمت $1.200 / 1M $0.870 / 1M
کل ان پٹ ٹوکنز 276,199 253,462
آؤٹ پٹ ٹوکنز 17,473 40,269
ریزننگ ٹوکنز 0 185,716
ردِعمل کا وقت (اوسط) 8.50s 56.72s
ردِعمل کا وقت (زیادہ سے زیادہ) 81.77s 333.34s
ردِعمل کا وقت (کل) 195.60s 1304.54s
پیرامیٹرز 1.6T کل (48B فعال) 1.02T کل (42B فعال)
دستیابی کھلا ماخذ کھلا ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#211 LongCat 2.0

none
لاگت
$0.027
وقت
411.7s
ٹوکنز
22,283 tok

#208 MiMo-V2.5-Pro

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
لاگت
$0.000
وقت
300.0s
ٹوکنز
0 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں