नेविगेशन
Advertise here

LongCat 2.0 vs MiMo-V2.5-Pro (medium)

average score लगभग बराबर है: 6.4 vs 6.4. LongCat 2.0 की benchmark लागत कम है: $0.104 vs $0.502. LongCat 2.0 तेज है: 8.50s vs 56.72s, pass rates 42.0% vs 63.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#211
कुल आउटपुट टोकन
17,473
प्रतिक्रिया समय (औसत)
8.50s
कुल लागत
$0.104
रैंक
#208
कुल आउटपुट टोकन
225,985
प्रतिक्रिया समय (औसत)
56.72s
कुल लागत
$0.502
अनुशंसित मॉडल LongCat 2.0

It has the best score here (6.4), while costing about 4.8x less than MiMo-V2.5-Pro (medium).

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 none रिलीज़: 2026-07-20 MiMo-V2.5-Pro MiMo-V2.5-Pro medium रिलीज़: 2026-04-22
स्कोर 6.4 6.4
रैंक #211 #208
विश्वसनीयता 10.0 10.0
संगति 9.0 7.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 42.0% 63.8%
अस्थिर टेस्ट 3 7
कुल रन 69 69
प्रति परिणाम लागत 1.298 4.559
कुल लागत $0.104 $0.502
इनपुट कीमत $0.300 / 1M $0.435 / 1M
आउटपुट कीमत $1.200 / 1M $0.870 / 1M
कुल इनपुट टोकन 276,199 253,462
आउटपुट टोकन 17,473 40,269
रीजनिंग टोकन 0 185,716
प्रतिक्रिया समय (औसत) 8.50s 56.72s
प्रतिक्रिया समय (अधिकतम) 81.77s 333.34s
प्रतिक्रिया समय (कुल) 195.60s 1304.54s
पैरामीटर 1.6T कुल (48B सक्रिय) 1.02T कुल (42B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#211 LongCat 2.0

none
लागत
$0.027
समय
411.7s
टोकन
22,283 tok

#208 MiMo-V2.5-Pro

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218

त्वरित तुलना

तुलना जोड़ी बदलें