नेविगेशन
Advertise here

LongCat 2.0 (low) vs GPT-5.6 Sol

GPT-5.6 Sol average score में आगे है: 6.7 vs 6.6. GPT-5.6 Sol की benchmark लागत कम है: $0.472 vs $0.495. GPT-5.6 Sol तेज है: 4.61s vs 115.00s, pass rates 55.1% vs 60.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#188
कुल आउटपुट टोकन
346,225
प्रतिक्रिया समय (औसत)
115.00s
कुल लागत
$0.495
रैंक
#183
कुल आउटपुट टोकन
5,555
प्रतिक्रिया समय (औसत)
4.61s
कुल लागत
$0.472
अनुशंसित मॉडल GPT-5.6 Sol

It has the best score here (6.7), while responding about 25.0x faster than LongCat 2.0 (low).

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 low रिलीज़: 2026-07-20 GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09
स्कोर 6.6 6.7
रैंक #188 #183
विश्वसनीयता 9.9 10.0
संगति 8.3 9.1
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 55.1% 60.9%
अस्थिर टेस्ट 5 3
कुल रन 69 69
प्रति परिणाम लागत 4.942 6.619
कुल लागत $0.495 $0.472
इनपुट कीमत $0.300 / 1M $2.000 / 1M
आउटपुट कीमत $1.200 / 1M $10.000 / 1M
कुल इनपुट टोकन 262,387 207,852
आउटपुट टोकन 7,344 5,555
रीजनिंग टोकन 338,881 0
प्रतिक्रिया समय (औसत) 115.00s 4.61s
प्रतिक्रिया समय (अधिकतम) 560.39s 58.28s
प्रतिक्रिया समय (कुल) 2645.11s 105.93s
पैरामीटर 1.6T कुल (48B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#188 LongCat 2.0

low
लागत
$0.024
समय
428.0s
टोकन
19,557 tok

#183 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0

त्वरित तुलना

तुलना जोड़ी बदलें