- क्रमांक
- #138
- एकूण आउटपुट टोकन्स
- 404,635
- प्रतिसाद वेळ (सरासरी)
- 151.67s
- एकूण खर्च
- $0.778
LongCat 2.0 (high) vs GLM 5 (medium)
LongCat 2.0 (high) average score मध्ये पुढे आहे: 7.3 vs 7.2. GLM 5 (medium) चा benchmark खर्च कमी आहे: $0.479 vs $0.778. GLM 5 (medium) वेगवान आहे: 39.05s vs 151.67s, pass rates 53.6% vs 76.8%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #148
- एकूण आउटपुट टोकन्स
- 138,257
- प्रतिसाद वेळ (सरासरी)
- 39.05s
- एकूण खर्च
- $0.479
शिफारस केलेले मॉडेल
GLM 5 (medium)
Its score stays close to the best score here (7.2 vs 7.3), while costing about 1.6x less than LongCat 2.0 (high).
तपशीलवार तुलना
| मेट्रिक | LongCat 2.0 LongCat 2.0 high | GLM 5 GLM 5 medium |
|---|---|---|
| स्कोअर | 7.3 | 7.2 |
| क्रमांक | #138 | #148 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 8.5 | 7.9 |
| प्रयत्न | 69/69 | 66/69 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 53.6% | 76.8% |
| अस्थिर चाचण्या | 4 | 5 |
| एकूण रन | 69 | 66 |
| प्रति निकाल खर्च | 5.681 | 2.552 |
| एकूण खर्च | $0.778 | $0.479 |
| इनपुट किंमत | $0.300 / 1M | $0.600 / 1M |
| आउटपुट किंमत | $1.200 / 1M | $1.920 / 1M |
| कॅश वाचण्याची किंमत | $0.006 / 1M | $0.120 / 1M |
| कॅश लिहिण्याची किंमत | लागू नाही | लागू नाही |
| एकूण इनपुट टोकन्स | 275,080 | 212,440 |
| आउटपुट टोकन्स | 32,447 | 22,922 |
| रिझनिंग टोकन्स | 372,188 | 115,335 |
| प्रतिसाद वेळ (सरासरी) | 151.67s | 39.05s |
| प्रतिसाद वेळ (कमाल) | 941.66s | 110.70s |
| प्रतिसाद वेळ (एकूण) | 3488.43s | 546.68s |
| पॅरामीटर्स | 1.6T एकूण (48B सक्रिय) | 744B एकूण (40B सक्रिय) |
| उपलब्धता | मुक्त स्रोत | मुक्त स्रोत |
कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#138 LongCat 2.0
high
Reached the allocated time limit (600 seconds) without receiving showcase output.
- खर्च
- $0.000
- वेळ
- 600.0s
- टोकन्स
- 0 tok
#148 GLM 5
medium- खर्च
- $0.005
- वेळ
- 20.7s
- टोकन्स
- 2,068 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
| स्वायत्त एजंट कार्ये | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 116.07s | 181,669 | 1,977 | 16,016 | |
| GLM 5 | 4.7 | 3.1 | 33.3% | 1 | 110.70s | 177,216 | 1,352 | 12,339 |
| अँटी-एआय युक्त्या | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 8.9 | 8.1 | 91.7% | 1 | 7.76s | 588 | 303 | 3,300 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 23.66s | 555 | 480 | 7,056 |
| कोडिंग | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 7.8 | 9.3 | 66.7% | 0 | 505.33s | 6,913 | 244 | 192,377 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 74.30s | 7,254 | 2,997 | 52,930 |
| संयुक्त | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 167.13s | 68,941 | 4,934 | 49,558 | |
| GLM 5 | 5.0 | 5.0 | 50.0% | 0 | 28.96s | 12,804 | 662 | 3,242 |
| डेटा पार्सिंग आणि निष्कर्षण | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.6 | 5.8 | 33.3% | 1 | 10.98s | 7,653 | 197 | 2,714 | |
| GLM 5 | 7.1 | 5.6 | 83.3% | 1 | 8.90s | 5,508 | 567 | 3,734 |
| डोमेन-विशिष्ट | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.6 | 7.2 | 22.2% | 1 | 433.73s | 505 | 23,928 | 86,947 | |
| GLM 5 | 3.5 | 4.4 | 33.3% | 2 | 0ms | 260 | 13,176 | 14,137 |
| Samanya Buddhimatta | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 5.1 | 10.0 | 0.0% | 0 | 17.00s | 480 | 111 | 1,748 | |
| GLM 5 | 6.1 | 3.1 | 66.7% | 1 | 14.69s | 477 | 2,020 | 2,248 |
| सूचनांचे पालन | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.5 | 10.0 | 50.0% | 0 | 6.96s | 657 | 78 | 1,726 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 7.25s | 636 | 1,001 | 2,129 |
| कोडी सोडवणे | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.1 | 7.4 | 11.1% | 1 | 9.18s | 636 | 379 | 2,778 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 11.33s | 609 | 33 | 4,076 |
| टूल कॉलिंग | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 10.02s | 6,840 | 249 | 505 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 15.93s | 6,935 | 233 | 994 |
| सामान्य ज्ञान | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.0 | 10.0 | 0.0% | 0 | 99.44s | 198 | 47 | 14,519 | |
| GLM 5 | 3.0 | 10.0 | 0.0% | 0 | 67.37s | 186 | 401 | 12,450 |
झटपट तुलना
तुलना जोडी बदला
Gemini 2.5 FlashmediumvsLongCat 2.0highStep 3.7 FlashlowvsGLM 5mediumLongCat 2.0highvsQwen3.6 PlusmediumGemini 3.5 Flash LitemediumvsLongCat 2.0highLongCat 2.0highvsGrok 4.7mediumQwen3.7 FlashhighvsGLM 5mediumClaude Fable 5.1mediumvsLongCat 2.0highClaude Opus 5nonevsGLM 5mediumClaude Opus 4.8lowvsGLM 5mediumGemini 3.8 FlashlowvsGLM 5mediumLongCat 2.0highvsQwen3.5-27BnoneLongCat 2.0highvsQwen3.5 Plus 2026-02-15medium