नेविगेशन
AI BENCHY
Advertise here

LongCat 2.0 (low) vs GLM 5.2

average score लगभग बराबर है: 6.7 vs 6.7. GLM 5.2 की benchmark लागत कम है: $0.153 vs $0.412. GLM 5.2 तेज है: 9.65s vs 113.61s, pass rates 54.6% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-03

रैंक
#152
कुल आउटपुट टोकन
320,594
प्रतिक्रिया समय (औसत)
113.61s
कुल लागत
$0.412
रैंक
#150
कुल आउटपुट टोकन
14,344
प्रतिक्रिया समय (औसत)
9.65s
कुल लागत
$0.153
अनुशंसित मॉडल GLM 5.2

It has the best score here (6.7), while costing about 2.7x less than LongCat 2.0 (low).

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 low रिलीज़: 2026-07-20 GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 6.7 6.7
रैंक #152 #150
विश्वसनीयता 9.9 10.0
संगति 8.5 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 54.6% 63.6%
अस्थिर टेस्ट 4 2
कुल रन 66 66
प्रति परिणाम लागत 4.120 1.312
कुल लागत $0.412 $0.153
इनपुट कीमत $0.300 / 1M $0.966 / 1M
आउटपुट कीमत $1.200 / 1M $3.036 / 1M
कुल इनपुट टोकन 90,870 112,458
आउटपुट टोकन 5,676 14,344
रीजनिंग टोकन 314,918 0
प्रतिक्रिया समय (औसत) 113.61s 9.65s
प्रतिक्रिया समय (अधिकतम) 560.39s 79.65s
प्रतिक्रिया समय (कुल) 2499.46s 212.38s
पैरामीटर 1.6T कुल (48B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#152 LongCat 2.0

low
लागत
$0.024
समय
428.0s
टोकन
19,557 tok

#150 GLM 5.2

none
अमान्य SVG
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

त्वरित तुलना

तुलना जोड़ी बदलें