नेविगेशन
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Xiaomi: MiMo-V2.5-Pro

MiMo-V2.5-Pro (medium) average score में आगे है: 6.9 vs 6.7. MiMo-V2.5-Pro (medium) की benchmark लागत कम है: $0.187 vs $0.391. MiMo-V2.5-Pro (medium) तेज है: 33.92s vs 100.31s, pass rates 53.0% vs 66.7%.

अनुशंसित मॉडलMiMo-V2.5-Pro (medium)It has the best score here (6.9), while costing about 2.1x less than LongCat 2.0 (low).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-21

मेट्रिक LongCat 2.0 LongCat 2.0 low रिलीज़: 2026-07-20 MiMo-V2.5-Pro MiMo-V2.5-Pro medium रिलीज़: 2026-04-22
स्कोर 6.7 6.9
रैंक #96 #88
विश्वसनीयता 9.6 10.0
संगति 8.9 8.2
सही परीक्षण
प्रति प्रयास पास दर 53.0% 66.7%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 3.910 3.218
कुल लागत $0.391 $0.187
इनपुट कीमत $0.300 / 1M $0.435 / 1M
आउटपुट कीमत $1.200 / 1M $0.870 / 1M
कुल इनपुट टोकन 90,909 139,883
आउटपुट टोकन 5,679 15,521
रीजनिंग टोकन 297,369 130,992
प्रतिक्रिया समय (औसत) 100.31s 33.92s
प्रतिक्रिया समय (अधिकतम) 560.39s 197.54s
प्रतिक्रिया समय (कुल) 2206.82s 746.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 LongCat 2.0

low
लागत
$0.024
समय
428.0s
टोकन
19,557 tok

#88 MiMo-V2.5-Pro

medium
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218

त्वरित तुलना

तुलना जोड़ी बदलें