- रैंक
- #94
- कुल आउटपुट टोकन
- 390,873
- प्रतिक्रिया समय (औसत)
- 143.55s
- कुल लागत
- $0.499
LongCat 2.0 (medium) vs Grok Build 0.1 (medium)
average score लगभग बराबर है: 7.4 vs 7.5. LongCat 2.0 (medium) की benchmark लागत कम है: $0.499 vs $1.130. Grok Build 0.1 (medium) तेज है: 54.50s vs 143.55s, pass rates 59.1% vs 60.6%.
- रैंक
- #89
- कुल आउटपुट टोकन
- 511,406
- प्रतिक्रिया समय (औसत)
- 54.50s
- कुल लागत
- $1.130
अनुशंसित मॉडल
LongCat 2.0 (medium)
It has the best score here (7.4), while costing about 2.3x less than Grok Build 0.1 (medium).
विस्तृत तुलना
| मेट्रिक | LongCat 2.0 LongCat 2.0 medium | Grok Build 0.1 Grok Build 0.1 medium |
|---|---|---|
| स्कोर | 7.4 | 7.5 |
| रैंक | #94 | #89 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 9.3 | 9.6 |
| प्रयास | 66/66 | 66/66 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 59.1% | 60.6% |
| अस्थिर टेस्ट | 2 | 1 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 4.153 | 8.691 |
| कुल लागत | $0.499 | $1.130 |
| इनपुट कीमत | $0.300 / 1M | $1.000 / 1M |
| आउटपुट कीमत | $1.200 / 1M | $2.000 / 1M |
| कुल इनपुट टोकन | 97,324 | 106,946 |
| आउटपुट टोकन | 44,383 | 7,993 |
| रीजनिंग टोकन | 346,490 | 503,413 |
| प्रतिक्रिया समय (औसत) | 143.55s | 54.50s |
| प्रतिक्रिया समय (अधिकतम) | 939.52s | 252.69s |
| प्रतिक्रिया समय (कुल) | 3158.11s | 1199.07s |
| पैरामीटर | 1.6T कुल (48B सक्रिय) | ~300B कुल (~30B सक्रिय) |
| उपलब्धता | मुक्त स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#94 LongCat 2.0
medium- लागत
- $0.016
- समय
- 285.1s
- टोकन
- 13,057 tok
#89 SpaceXAI: Grok Build 0.1
medium- लागत
- $0.028
- समय
- 81.3s
- टोकन
- 14,009 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
| एंटी-एआई ट्रिक्स | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 9.65s | 588 | 201 | 4,412 | |
| Grok Build 0.1 | 8.3 | 10.0 | 75.0% | 0 | 7.43s | 2,010 | 220 | 12,162 |
| कोडिंग | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 455.00s | 7,419 | 533 | 214,143 | |
| Grok Build 0.1 | 5.7 | 9.7 | 33.3% | 0 | 108.46s | 8,304 | 1,138 | 161,452 |
| संयुक्त | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 7.3 | 5.8 | 83.3% | 1 | 151.04s | 72,348 | 4,675 | 38,668 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 65.08s | 75,242 | 5,442 | 65,569 |
| डेटा पार्सिंग और निष्कर्षण | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.3 | 10.0 | 50.0% | 0 | 10.63s | 7,653 | 198 | 2,536 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 10.72s | 7,761 | 180 | 8,876 |
| डोमेन-विशिष्ट | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.0 | 10.0 | 0.0% | 0 | 390.56s | 505 | 37,854 | 54,558 | |
| Grok Build 0.1 | 2.9 | 7.2 | 11.1% | 1 | 175.94s | 1,959 | 492 | 192,037 |
| Samanya Buddhimatta | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 4.8 | 3.2 | 33.3% | 1 | 16.35s | 480 | 121 | 1,598 | |
| Grok Build 0.1 | 4.4 | 9.9 | 0.0% | 0 | 18.41s | 825 | 76 | 6,345 |
| निर्देश पालन | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.5 | 10.0 | 50.0% | 0 | 7.38s | 657 | 78 | 1,652 | |
| Grok Build 0.1 | 9.8 | 10.0 | 100.0% | 0 | 12.36s | 1,362 | 57 | 9,599 |
| पहेली समाधान | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 5.4 | 10.0 | 33.3% | 0 | 8.84s | 636 | 388 | 2,562 | |
| Grok Build 0.1 | 7.7 | 10.0 | 66.7% | 0 | 18.26s | 1,689 | 195 | 20,841 |
| टूल कॉलिंग | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 10.67s | 6,840 | 249 | 581 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 13.12s | 7,263 | 180 | 4,969 |
| सामान्य ज्ञान | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.0 | 10.0 | 0.0% | 0 | 191.19s | 198 | 86 | 25,780 | |
| Grok Build 0.1 | 3.0 | 10.0 | 0.0% | 0 | 53.51s | 531 | 13 | 21,563 |
त्वरित तुलना
तुलना जोड़ी बदलें
Qwen3.7 MaxnonevsGrok Build 0.1mediumGPT 5.3 ChatnonevsGrok Build 0.1mediumLongCat 2.0mediumvsQwen3.7 MaxnoneLongCat 2.0mediumvsQwen3.8 2.4T A95BhighGPT-5.6 TerralowvsGrok Build 0.1mediumLongCat 2.0mediumvsGrok 4.6lowGemini 3 Flash PreviewlowvsLongCat 2.0mediumLongCat 2.0mediumvsGPT 5.3 ChatnoneQwen3.8 2.4T A95BhighvsGrok Build 0.1mediumLongCat 2.0mediumvsGPT-5.6 TerralowClaude Sonnet 4.6nonevsLongCat 2.0mediumGemini 3 Flash PreviewlowvsGrok Build 0.1medium