नेव्हिगेशन
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Xiaomi: MiMo-V2.5-Pro

MiMo-V2.5-Pro (medium) average score मध्ये पुढे आहे: 6.9 vs 6.7. MiMo-V2.5-Pro (medium) चा benchmark खर्च कमी आहे: $0.187 vs $0.391. MiMo-V2.5-Pro (medium) वेगवान आहे: 33.92s vs 100.31s, pass rates 53.0% vs 66.7%.

शिफारस केलेले मॉडेलMiMo-V2.5-Pro (medium)It has the best score here (6.9), while costing about 2.1x less than LongCat 2.0 (low).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक LongCat 2.0 LongCat 2.0 low प्रकाशन: 2026-07-20 MiMo-V2.5-Pro MiMo-V2.5-Pro medium प्रकाशन: 2026-04-22
स्कोअर 6.7 6.9
क्रमांक #96 #88
विश्वसनीयता 9.6 10.0
सुसंगतता 8.9 8.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 53.0% 66.7%
अस्थिर चाचण्या 3 5
एकूण रन 66 66
प्रति निकाल खर्च 3.910 3.218
एकूण खर्च $0.391 $0.187
इनपुट किंमत $0.300 / 1M $0.435 / 1M
आउटपुट किंमत $1.200 / 1M $0.870 / 1M
एकूण इनपुट टोकन्स 90,909 139,883
आउटपुट टोकन्स 5,679 15,521
रिझनिंग टोकन्स 297,369 130,992
प्रतिसाद वेळ (सरासरी) 100.31s 33.92s
प्रतिसाद वेळ (कमाल) 560.39s 197.54s
प्रतिसाद वेळ (एकूण) 2206.82s 746.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 LongCat 2.0

low
खर्च
$0.024
वेळ
428.0s
टोकन्स
19,557 tok

#88 MiMo-V2.5-Pro

medium
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218

झटपट तुलना

तुलना जोडी बदला