नेव्हिगेशन
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Z.ai: GLM 5.2

average score जवळपास समान आहे: 6.6 vs 6.6. GLM 5.2 चा benchmark खर्च कमी आहे: $0.151 vs $0.469. GLM 5.2 वेगवान आहे: 9.34s vs 148.73s, pass rates 53.0% vs 59.1%.

शिफारस केलेले मॉडेलGLM 5.2It has the best score here (6.6), while costing about 3.1x less than LongCat 2.0 (high).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-20

मेट्रिक LongCat 2.0 LongCat 2.0 high प्रकाशन: 2026-07-20 GLM 5.2 GLM 5.2 none प्रकाशन: 2026-06-17
स्कोअर 6.6 6.6
क्रमांक #97 #96
विश्वसनीयता 9.4 10.0
सुसंगतता 8.2 9.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 53.0% 59.1%
अस्थिर चाचण्या 5 2
एकूण रन 66 64
प्रति निकाल खर्च 5.202 1.421
एकूण खर्च $0.469 $0.151
इनपुट किंमत $0.300 / 1M $0.960 / 1M
आउटपुट किंमत $1.200 / 1M $3.014 / 1M
एकूण इनपुट टोकन्स 93,357 112,359
आउटपुट टोकन्स 30,466 14,340
रिझनिंग टोकन्स 336,325 0
प्रतिसाद वेळ (सरासरी) 148.73s 9.34s
प्रतिसाद वेळ (कमाल) 941.66s 79.65s
प्रतिसाद वेळ (एकूण) 3272.00s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 LongCat 2.0

high
अवैध SVG
खर्च
$0.000
वेळ
600.0s
टोकन्स
0 tok

#96 GLM 5.2

none
अवैध SVG
खर्च
$0.033
वेळ
87.7s
टोकन्स
7,455 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 7.6 7.2 77.8% 1 505.33s 6,913 244 192,377
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

झटपट तुलना

तुलना जोडी बदला