नेव्हिगेशन
AI BENCHY
Advertise here

LongCat 2.0 vs MiMo-V2.5 (medium)

average score जवळपास समान आहे: 6.4 vs 6.4. LongCat 2.0 चा benchmark खर्च कमी आहे: $0.044 vs $0.104. LongCat 2.0 वेगवान आहे: 5.17s vs 46.28s, pass rates 40.9% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-04

क्रमांक
#177
एकूण आउटपुट टोकन्स
9,375
प्रतिसाद वेळ (सरासरी)
5.17s
एकूण खर्च
$0.044
क्रमांक
#178
एकूण आउटपुट टोकन्स
327,048
प्रतिसाद वेळ (सरासरी)
46.28s
एकूण खर्च
$0.104
शिफारस केलेले मॉडेल LongCat 2.0

It has the best score here (6.4), while costing about 2.4x less than MiMo-V2.5 (medium).

तपशीलवार तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 none प्रकाशन: 2026-07-20 MiMo-V2.5 MiMo-V2.5 medium प्रकाशन: 2026-04-22
स्कोअर 6.4 6.4
क्रमांक #177 #178
विश्वसनीयता 10.0 10.0
सुसंगतता 9.3 7.5
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 40.9% 68.2%
अस्थिर चाचण्या 2 7
एकूण रन 66 66
प्रति निकाल खर्च 0.549 3.575
एकूण खर्च $0.044 $0.104
इनपुट किंमत $0.300 / 1M $0.140 / 1M
आउटपुट किंमत $1.200 / 1M $0.280 / 1M
एकूण इनपुट टोकन्स 108,752 105,456
आउटपुट टोकन्स 9,375 7,108
रिझनिंग टोकन्स 0 319,940
प्रतिसाद वेळ (सरासरी) 5.17s 46.28s
प्रतिसाद वेळ (कमाल) 48.38s 316.27s
प्रतिसाद वेळ (एकूण) 113.83s 1018.12s
पॅरामीटर्स 1.6T एकूण (48B सक्रिय) 310B एकूण (15B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#177 LongCat 2.0

none
खर्च
$0.027
वेळ
411.7s
टोकन्स
22,283 tok

#178 MiMo-V2.5

medium
खर्च
$0.002
वेळ
54.8s
टोकन्स
5,247 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

झटपट तुलना

तुलना जोडी बदला