नेविगेशन
Advertise here

MiMo-V2.5-Pro (medium) vs GLM 5.2

average score लगभग बराबर है: 6.8 vs 6.7. GLM 5.2 की benchmark लागत कम है: $0.090 vs $0.221. GLM 5.2 तेज है: 9.65s vs 48.68s, pass rates 63.6% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#192
कुल आउटपुट टोकन
185,466
प्रतिक्रिया समय (औसत)
48.68s
कुल लागत
$0.221
रैंक
#196
कुल आउटपुट टोकन
14,344
प्रतिक्रिया समय (औसत)
9.65s
कुल लागत
$0.090
अनुशंसित मॉडल GLM 5.2

It has the best score here (6.7), while costing about 2.5x less than MiMo-V2.5-Pro (medium).

विस्तृत तुलना

मेट्रिक MiMo-V2.5-Pro MiMo-V2.5-Pro medium रिलीज़: 2026-04-22 GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 6.8 6.7
रैंक #192 #196
विश्वसनीयता 10.0 10.0
संगति 7.9 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 63.6%
अस्थिर टेस्ट 6 2
कुल रन 66 66
प्रति परिणाम लागत 3.790 1.312
कुल लागत $0.221 $0.090
इनपुट कीमत $0.435 / 1M $0.234 / 1M
आउटपुट कीमत $0.870 / 1M $4.400 / 1M
कुल इनपुट टोकन 139,892 112,458
आउटपुट टोकन 15,569 14,344
रीजनिंग टोकन 169,897 0
प्रतिक्रिया समय (औसत) 48.68s 9.65s
प्रतिक्रिया समय (अधिकतम) 333.34s 79.65s
प्रतिक्रिया समय (कुल) 1071.02s 212.38s
पैरामीटर 1.02T कुल (42B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#192 MiMo-V2.5-Pro

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

#196 GLM 5.2

none
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

त्वरित तुलना

तुलना जोड़ी बदलें