नेव्हिगेशन
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Z.ai: GLM 5.2

LongCat 2.0 (low) average score मध्ये पुढे आहे: 6.7 vs 6.6. GLM 5.2 चा benchmark खर्च कमी आहे: $0.128 vs $0.391. GLM 5.2 वेगवान आहे: 9.34s vs 100.31s, pass rates 53.0% vs 59.1%.

शिफारस केलेले मॉडेलGLM 5.2Its score stays close to the best score here (6.6 vs 6.7), while costing about 3.1x less than LongCat 2.0 (low).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक LongCat 2.0 LongCat 2.0 low प्रकाशन: 2026-07-20 GLM 5.2 GLM 5.2 none प्रकाशन: 2026-06-17
स्कोअर 6.7 6.6
क्रमांक #96 #101
विश्वसनीयता 9.6 10.0
सुसंगतता 8.9 9.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 53.0% 59.1%
अस्थिर चाचण्या 3 2
एकूण रन 66 64
प्रति निकाल खर्च 3.910 1.421
एकूण खर्च $0.391 $0.128
इनपुट किंमत $0.300 / 1M $0.808 / 1M
आउटपुट किंमत $1.200 / 1M $2.539 / 1M
एकूण इनपुट टोकन्स 90,909 112,359
आउटपुट टोकन्स 5,679 14,340
रिझनिंग टोकन्स 297,369 0
प्रतिसाद वेळ (सरासरी) 100.31s 9.34s
प्रतिसाद वेळ (कमाल) 560.39s 79.65s
प्रतिसाद वेळ (एकूण) 2206.82s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 LongCat 2.0

low
खर्च
$0.024
वेळ
428.0s
टोकन्स
19,557 tok

#101 GLM 5.2

none
अवैध SVG
खर्च
$0.033
वेळ
87.7s
टोकन्स
7,455 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

झटपट तुलना

तुलना जोडी बदला