नेविगेशन
Advertise here

LongCat 2.0 (low) vs GPT-5.5

average score लगभग बराबर है: 6.6 vs 6.6. LongCat 2.0 (low) की benchmark लागत कम है: $0.495 vs $1.212. GPT-5.5 तेज है: 4.75s vs 115.00s, pass rates 55.1% vs 56.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#188
कुल आउटपुट टोकन
346,225
प्रतिक्रिया समय (औसत)
115.00s
कुल लागत
$0.495
रैंक
#185
कुल आउटपुट टोकन
6,197
प्रतिक्रिया समय (औसत)
4.75s
कुल लागत
$1.212
अनुशंसित मॉडल GPT-5.5

It has the best score here (6.6), while responding about 24.2x faster than LongCat 2.0 (low).

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 low रिलीज़: 2026-07-20 GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24
स्कोर 6.6 6.6
रैंक #188 #185
विश्वसनीयता 9.9 10.0
संगति 8.3 9.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 55.1% 56.5%
अस्थिर टेस्ट 5 2
कुल रन 69 69
प्रति परिणाम लागत 4.942 10.096
कुल लागत $0.495 $1.212
इनपुट कीमत $0.300 / 1M $5.000 / 1M
आउटपुट कीमत $1.200 / 1M $30.000 / 1M
कुल इनपुट टोकन 262,387 205,108
आउटपुट टोकन 7,344 6,197
रीजनिंग टोकन 338,881 0
प्रतिक्रिया समय (औसत) 115.00s 4.75s
प्रतिक्रिया समय (अधिकतम) 560.39s 57.53s
प्रतिक्रिया समय (कुल) 2645.11s 109.31s
पैरामीटर 1.6T कुल (48B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#188 LongCat 2.0

low
लागत
$0.024
समय
428.0s
टोकन
19,557 tok

#185 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

त्वरित तुलना

तुलना जोड़ी बदलें