नेविगेशन
Advertise here

LongCat 2.0 (low) vs GPT 5.3 Chat

GPT 5.3 Chat average score में आगे है: 6.7 vs 6.6. LongCat 2.0 (low) की benchmark लागत कम है: $0.495 vs $0.533. GPT 5.3 Chat तेज है: 6.31s vs 115.00s, pass rates 55.1% vs 62.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#188
कुल आउटपुट टोकन
346,225
प्रतिक्रिया समय (औसत)
115.00s
कुल लागत
$0.495
रैंक
#182
कुल आउटपुट टोकन
28,179
प्रतिक्रिया समय (औसत)
6.31s
कुल लागत
$0.533
अनुशंसित मॉडल GPT 5.3 Chat

It has the best score here (6.7), while responding about 18.2x faster than LongCat 2.0 (low).

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 low रिलीज़: 2026-07-20 GPT 5.3 Chat GPT 5.3 Chat none रिलीज़: 2026-03-03
स्कोर 6.6 6.7
रैंक #188 #182
विश्वसनीयता 9.9 10.0
संगति 8.3 8.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 55.1% 62.3%
अस्थिर टेस्ट 5 4
कुल रन 69 69
प्रति परिणाम लागत 4.942 4.097
कुल लागत $0.495 $0.533
इनपुट कीमत $0.300 / 1M $0.000 / 1M
आउटपुट कीमत $1.200 / 1M $0.000 / 1M
कुल इनपुट टोकन 262,387 78,846
आउटपुट टोकन 7,344 28,179
रीजनिंग टोकन 338,881 0
प्रतिक्रिया समय (औसत) 115.00s 6.31s
प्रतिक्रिया समय (अधिकतम) 560.39s 18.33s
प्रतिक्रिया समय (कुल) 2645.11s 138.73s
पैरामीटर 1.6T कुल (48B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#188 LongCat 2.0

low
लागत
$0.024
समय
428.0s
टोकन
19,557 tok

#182 GPT 5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

त्वरित तुलना

तुलना जोड़ी बदलें