- क्रमांक
- #94
- एकूण आउटपुट टोकन्स
- 390,873
- प्रतिसाद वेळ (सरासरी)
- 143.55s
- एकूण खर्च
- $0.499
LongCat 2.0 (medium) vs Grok Build 0.1 (medium)
average score जवळपास समान आहे: 7.4 vs 7.5. LongCat 2.0 (medium) चा benchmark खर्च कमी आहे: $0.499 vs $1.130. Grok Build 0.1 (medium) वेगवान आहे: 54.50s vs 143.55s, pass rates 59.1% vs 60.6%.
- क्रमांक
- #89
- एकूण आउटपुट टोकन्स
- 511,406
- प्रतिसाद वेळ (सरासरी)
- 54.50s
- एकूण खर्च
- $1.130
शिफारस केलेले मॉडेल
LongCat 2.0 (medium)
It has the best score here (7.4), while costing about 2.3x less than Grok Build 0.1 (medium).
तपशीलवार तुलना
| मेट्रिक | LongCat 2.0 LongCat 2.0 medium | Grok Build 0.1 Grok Build 0.1 medium |
|---|---|---|
| स्कोअर | 7.4 | 7.5 |
| क्रमांक | #94 | #89 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 9.3 | 9.6 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 59.1% | 60.6% |
| अस्थिर चाचण्या | 2 | 1 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 4.153 | 8.691 |
| एकूण खर्च | $0.499 | $1.130 |
| इनपुट किंमत | $0.300 / 1M | $1.000 / 1M |
| आउटपुट किंमत | $1.200 / 1M | $2.000 / 1M |
| एकूण इनपुट टोकन्स | 97,324 | 106,946 |
| आउटपुट टोकन्स | 44,383 | 7,993 |
| रिझनिंग टोकन्स | 346,490 | 503,413 |
| प्रतिसाद वेळ (सरासरी) | 143.55s | 54.50s |
| प्रतिसाद वेळ (कमाल) | 939.52s | 252.69s |
| प्रतिसाद वेळ (एकूण) | 3158.11s | 1199.07s |
| पॅरामीटर्स | 1.6T एकूण (48B सक्रिय) | ~300B एकूण (~30B सक्रिय) |
| उपलब्धता | मुक्त स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#94 LongCat 2.0
medium- खर्च
- $0.016
- वेळ
- 285.1s
- टोकन्स
- 13,057 tok
#89 SpaceXAI: Grok Build 0.1
medium- खर्च
- $0.028
- वेळ
- 81.3s
- टोकन्स
- 14,009 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
| अँटी-एआय युक्त्या | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 9.65s | 588 | 201 | 4,412 | |
| Grok Build 0.1 | 8.3 | 10.0 | 75.0% | 0 | 7.43s | 2,010 | 220 | 12,162 |
| कोडिंग | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 455.00s | 7,419 | 533 | 214,143 | |
| Grok Build 0.1 | 5.7 | 9.7 | 33.3% | 0 | 108.46s | 8,304 | 1,138 | 161,452 |
| संयुक्त | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 7.3 | 5.8 | 83.3% | 1 | 151.04s | 72,348 | 4,675 | 38,668 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 65.08s | 75,242 | 5,442 | 65,569 |
| डेटा पार्सिंग आणि निष्कर्षण | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.3 | 10.0 | 50.0% | 0 | 10.63s | 7,653 | 198 | 2,536 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 10.72s | 7,761 | 180 | 8,876 |
| डोमेन-विशिष्ट | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.0 | 10.0 | 0.0% | 0 | 390.56s | 505 | 37,854 | 54,558 | |
| Grok Build 0.1 | 2.9 | 7.2 | 11.1% | 1 | 175.94s | 1,959 | 492 | 192,037 |
| Samanya Buddhimatta | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 4.8 | 3.2 | 33.3% | 1 | 16.35s | 480 | 121 | 1,598 | |
| Grok Build 0.1 | 4.4 | 9.9 | 0.0% | 0 | 18.41s | 825 | 76 | 6,345 |
| सूचनांचे पालन | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.5 | 10.0 | 50.0% | 0 | 7.38s | 657 | 78 | 1,652 | |
| Grok Build 0.1 | 9.8 | 10.0 | 100.0% | 0 | 12.36s | 1,362 | 57 | 9,599 |
| कोडी सोडवणे | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 5.4 | 10.0 | 33.3% | 0 | 8.84s | 636 | 388 | 2,562 | |
| Grok Build 0.1 | 7.7 | 10.0 | 66.7% | 0 | 18.26s | 1,689 | 195 | 20,841 |
| टूल कॉलिंग | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 10.67s | 6,840 | 249 | 581 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 13.12s | 7,263 | 180 | 4,969 |
| सामान्य ज्ञान | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.0 | 10.0 | 0.0% | 0 | 191.19s | 198 | 86 | 25,780 | |
| Grok Build 0.1 | 3.0 | 10.0 | 0.0% | 0 | 53.51s | 531 | 13 | 21,563 |
झटपट तुलना
तुलना जोडी बदला
Qwen3.7 MaxnonevsGrok Build 0.1mediumGPT 5.3 ChatnonevsGrok Build 0.1mediumLongCat 2.0mediumvsQwen3.7 MaxnoneLongCat 2.0mediumvsQwen3.8 2.4T A95BhighGPT-5.6 TerralowvsGrok Build 0.1mediumLongCat 2.0mediumvsGrok 4.6lowGemini 3 Flash PreviewlowvsLongCat 2.0mediumLongCat 2.0mediumvsGPT 5.3 ChatnoneQwen3.8 2.4T A95BhighvsGrok Build 0.1mediumLongCat 2.0mediumvsGPT-5.6 TerralowClaude Sonnet 4.6nonevsLongCat 2.0mediumGemini 3 Flash PreviewlowvsGrok Build 0.1medium