नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Xiaomi: MiMo-V2.5 vs Z.ai: GLM 5.2

सारांश

MiMo-V2.5 vs GLM 5.2 benchmark तुलना: GLM 5.2 average score में आगे है: 7.1 vs 6.7. MiMo-V2.5 की benchmark लागत कम है: $0.063 vs $0.076. GLM 5.2 तेज है: 6.34s vs 27.11s, pass rates 69.8% vs 60.3%.

अनुशंसित मॉडल: GLM 5.2 - It has the best score here (7.1), while responding about 4.3x faster than MiMo-V2.5.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-18

मेट्रिक MiMo-V2.5 MiMo-V2.5 medium रिलीज़: 2026-04-22 GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 6.7 7.1
रैंक #76 #61
विश्वसनीयता 10.0 9.9
संगति 8.1 9.6
सही परीक्षण
प्रति प्रयास पास दर 69.8% 60.3%
अस्थिर टेस्ट 5 1
कुल रन 63 63
प्रति परिणाम लागत 2.966 0.628
कुल लागत $0.063 $0.076
इनपुट कीमत $0.140 / 1M $1.400 / 1M
आउटपुट कीमत $0.280 / 1M $4.400 / 1M
कुल इनपुट टोकन 41,838 38,671
आउटपुट टोकन 2,827 4,817
रीजनिंग टोकन 198,898 0
प्रतिक्रिया समय (औसत) 27.11s 6.34s
प्रतिक्रिया समय (अधिकतम) 162.44s 20.69s
प्रतिक्रिया समय (कुल) 569.38s 133.19s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#76 MiMo-V2.5

medium
लागत
$0.002
समय
54.8s
टोकन
5,247 tok

#61 GLM 5.2

none
अमान्य SVG
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 621 281 1,739
GLM 5.2 8.3 10.0 75.0% 0 3.70s 567 313 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 15,060 363 7,609
GLM 5.2 10.0 10.0 100.0% 0 20.69s 14,296 1,489 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 7,746 306 5,714
GLM 5.2 10.0 10.0 100.0% 0 7.17s 7,113 204 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 735 507 49,478
GLM 5.2 5.3 10.0 33.3% 0 6.50s 696 27 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 492 121 418
GLM 5.2 6.1 3.1 66.7% 1 4.42s 480 82 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 672 88 801
GLM 5.2 9.8 10.0 100.0% 0 3.84s 642 66 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiMo-V2.5 8.2 7.2 88.9% 1 20.25s 660 279 33,254
GLM 5.2 7.7 10.0 66.7% 0 3.31s 618 265 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 8,220 303 2,424
GLM 5.2 10.0 10.0 100.0% 0 15.76s 6,807 400 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiMo-V2.5 3.0 10.0 0.0% 0 51.29s 210 22 15,484
GLM 5.2 3.0 10.0 0.0% 0 3.41s 189 13 0

त्वरित तुलना

तुलना जोड़ी बदलें