नेविगेशन
AI BENCHY
Advertise here

LongCat 2.0 (medium) vs GPT 5.3 Chat

GPT 5.3 Chat average score में आगे है: 7.5 vs 7.4. LongCat 2.0 (medium) की benchmark लागत कम है: $0.499 vs $0.533. GPT 5.3 Chat तेज है: 6.56s vs 143.55s, pass rates 59.1% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-03

रैंक
#104
कुल आउटपुट टोकन
390,873
प्रतिक्रिया समय (औसत)
143.55s
कुल लागत
$0.499
रैंक
#93
कुल आउटपुट टोकन
28,179
प्रतिक्रिया समय (औसत)
6.56s
कुल लागत
$0.533
अनुशंसित मॉडल GPT 5.3 Chat

It has the best score here (7.5), while responding about 21.9x faster than LongCat 2.0 (medium).

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 medium रिलीज़: 2026-07-20 GPT 5.3 Chat GPT 5.3 Chat none रिलीज़: 2026-03-03
स्कोर 7.4 7.5
रैंक #104 #93
विश्वसनीयता 10.0 10.0
संगति 9.3 8.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 59.1% 65.2%
अस्थिर टेस्ट 2 4
कुल रन 66 66
प्रति परिणाम लागत 4.153 4.097
कुल लागत $0.499 $0.533
इनपुट कीमत $0.300 / 1M $1.750 / 1M
आउटपुट कीमत $1.200 / 1M $14.000 / 1M
कुल इनपुट टोकन 97,324 78,846
आउटपुट टोकन 44,383 28,179
रीजनिंग टोकन 346,490 0
प्रतिक्रिया समय (औसत) 143.55s 6.56s
प्रतिक्रिया समय (अधिकतम) 939.52s 18.33s
प्रतिक्रिया समय (कुल) 3158.11s 137.77s
पैरामीटर 1.6T कुल (48B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 LongCat 2.0

medium
लागत
$0.016
समय
285.1s
टोकन
13,057 tok

#93 GPT 5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

त्वरित तुलना

तुलना जोड़ी बदलें