नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Meituan: LongCat 2.0 vs Z.ai: GLM 5.2

average score लगभग बराबर है: 6.6 vs 6.6. GLM 5.2 की benchmark लागत कम है: $0.151 vs $0.469. GLM 5.2 तेज है: 9.34s vs 148.73s, pass rates 53.0% vs 59.1%.

अनुशंसित मॉडलGLM 5.2It has the best score here (6.6), while costing about 3.1x less than LongCat 2.0 (high).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-20

मेट्रिक LongCat 2.0 LongCat 2.0 high रिलीज़: 2026-07-20 GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 6.6 6.6
रैंक #97 #96
विश्वसनीयता 9.4 10.0
संगति 8.2 9.2
सही परीक्षण
प्रति प्रयास पास दर 53.0% 59.1%
अस्थिर टेस्ट 5 2
कुल रन 66 64
प्रति परिणाम लागत 5.202 1.421
कुल लागत $0.469 $0.151
इनपुट कीमत $0.300 / 1M $0.960 / 1M
आउटपुट कीमत $1.200 / 1M $3.014 / 1M
कुल इनपुट टोकन 93,357 112,359
आउटपुट टोकन 30,466 14,340
रीजनिंग टोकन 336,325 0
प्रतिक्रिया समय (औसत) 148.73s 9.34s
प्रतिक्रिया समय (अधिकतम) 941.66s 79.65s
प्रतिक्रिया समय (कुल) 3272.00s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 LongCat 2.0

high
अमान्य SVG
लागत
$0.000
समय
600.0s
टोकन
0 tok

#96 GLM 5.2

none
अमान्य SVG
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 7.6 7.2 77.8% 1 505.33s 6,913 244 192,377
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

त्वरित तुलना

तुलना जोड़ी बदलें