नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

LongCat 2.0 (high) vs GLM 5 (medium)

LongCat 2.0 (high) average score में आगे है: 7.3 vs 7.2. GLM 5 (medium) की benchmark लागत कम है: $0.479 vs $0.778. GLM 5 (medium) तेज है: 39.05s vs 151.67s, pass rates 53.6% vs 76.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-03

तुलना किए गए मॉडल

रैंक
#138
कुल आउटपुट टोकन
404,635
प्रतिक्रिया समय (औसत)
151.67s
कुल लागत
$0.778
रैंक
#148
कुल आउटपुट टोकन
138,257
प्रतिक्रिया समय (औसत)
39.05s
कुल लागत
$0.479
अनुशंसित मॉडल GLM 5 (medium)

Its score stays close to the best score here (7.2 vs 7.3), while costing about 1.6x less than LongCat 2.0 (high).

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 high रिलीज़: 2026-07-20 GLM 5 GLM 5 medium रिलीज़: 2026-02-12
स्कोर 7.3 7.2
रैंक #138 #148
विश्वसनीयता 10.0 10.0
संगति 8.5 7.9
प्रयास 69/69 66/69
सही परीक्षण
प्रति प्रयास पास दर 53.6% 76.8%
अस्थिर टेस्ट 4 5
कुल रन 69 66
प्रति परिणाम लागत 5.681 2.552
कुल लागत $0.778 $0.479
इनपुट कीमत $0.300 / 1M $0.600 / 1M
आउटपुट कीमत $1.200 / 1M $1.920 / 1M
कैश पढ़ने की कीमत $0.006 / 1M $0.120 / 1M
कैश लिखने की कीमत लागू नहीं लागू नहीं
कुल इनपुट टोकन 275,080 212,440
आउटपुट टोकन 32,447 22,922
रीजनिंग टोकन 372,188 115,335
प्रतिक्रिया समय (औसत) 151.67s 39.05s
प्रतिक्रिया समय (अधिकतम) 941.66s 110.70s
प्रतिक्रिया समय (कुल) 3488.43s 546.68s
पैरामीटर 1.6T कुल (48B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#138 LongCat 2.0

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
लागत
$0.000
समय
600.0s
टोकन
0 tok

#148 GLM 5

medium
लागत
$0.005
समय
20.7s
टोकन
2,068 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 7.8 9.3 66.7% 0 505.33s 6,913 244 192,377
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

त्वरित तुलना

तुलना जोड़ी बदलें