नेविगेशन
AI BENCHY
Advertise here

LongCat 2.0 (high) vs GLM 5.2

GLM 5.2 average score में आगे है: 6.7 vs 6.7. GLM 5.2 की benchmark लागत कम है: $0.153 vs $0.492. GLM 5.2 तेज है: 9.65s vs 153.29s, pass rates 51.5% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-03

रैंक
#155
कुल आउटपुट टोकन
386,642
प्रतिक्रिया समय (औसत)
153.29s
कुल लागत
$0.492
रैंक
#150
कुल आउटपुट टोकन
14,344
प्रतिक्रिया समय (औसत)
9.65s
कुल लागत
$0.153
अनुशंसित मॉडल GLM 5.2

It has the best score here (6.7), while costing about 3.2x less than LongCat 2.0 (high).

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 high रिलीज़: 2026-07-20 GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 6.7 6.7
रैंक #155 #150
विश्वसनीयता 10.0 10.0
संगति 8.4 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 51.5% 63.6%
अस्थिर टेस्ट 4 2
कुल रन 66 66
प्रति परिणाम लागत 5.467 1.312
कुल लागत $0.492 $0.153
इनपुट कीमत $0.300 / 1M $0.966 / 1M
आउटपुट कीमत $1.200 / 1M $3.036 / 1M
कुल इनपुट टोकन 93,411 112,458
आउटपुट टोकन 30,470 14,344
रीजनिंग टोकन 356,172 0
प्रतिक्रिया समय (औसत) 153.29s 9.65s
प्रतिक्रिया समय (अधिकतम) 941.66s 79.65s
प्रतिक्रिया समय (कुल) 3372.36s 212.38s
पैरामीटर 1.6T कुल (48B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#155 LongCat 2.0

high
अमान्य SVG
लागत
$0.000
समय
600.0s
टोकन
0 tok

#150 GLM 5.2

none
अमान्य SVG
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 7.8 9.3 66.7% 0 505.33s 6,913 244 192,377
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

त्वरित तुलना

तुलना जोड़ी बदलें