नेविगेशन
AI BENCHY
Advertise here

LongCat 2.0 — high बनाम low

average score लगभग बराबर है: 6.7 vs 6.7. low की benchmark लागत कम है: $0.412 vs $0.492. low तेज है: 113.61s vs 153.29s, pass rates 51.5% vs 54.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-03

रैंक
#155
कुल आउटपुट टोकन
386,642
प्रतिक्रिया समय (औसत)
153.29s
कुल लागत
$0.492
रैंक
#152
कुल आउटपुट टोकन
320,594
प्रतिक्रिया समय (औसत)
113.61s
कुल लागत
$0.412
अनुशंसित मॉडल low

It has the strongest score in this comparison (6.7) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 high रिलीज़: 2026-07-20 LongCat 2.0 LongCat 2.0 low रिलीज़: 2026-07-20
स्कोर 6.7 6.7
रैंक #155 #152
विश्वसनीयता 10.0 9.9
संगति 8.4 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 51.5% 54.6%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 5.467 4.120
कुल लागत $0.492 $0.412
इनपुट कीमत $0.300 / 1M $0.300 / 1M
आउटपुट कीमत $1.200 / 1M $1.200 / 1M
कुल इनपुट टोकन 93,411 90,870
आउटपुट टोकन 30,470 5,676
रीजनिंग टोकन 356,172 314,918
प्रतिक्रिया समय (औसत) 153.29s 113.61s
प्रतिक्रिया समय (अधिकतम) 941.66s 560.39s
प्रतिक्रिया समय (कुल) 3372.36s 2499.46s
पैरामीटर 1.6T कुल (48B सक्रिय) 1.6T कुल (48B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#155 LongCat 2.0

high
अमान्य SVG
लागत
$0.000
समय
600.0s
टोकन
0 tok

#152 LongCat 2.0

low
लागत
$0.024
समय
428.0s
टोकन
19,557 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 7.8 9.3 66.7% 0 505.33s 6,913 244 192,377
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627

त्वरित तुलना

तुलना जोड़ी बदलें