नेव्हिगेशन
AI BENCHY
Advertise here

LongCat 2.0 (medium) vs GPT 5.3 Chat

GPT 5.3 Chat average score मध्ये पुढे आहे: 7.5 vs 7.4. LongCat 2.0 (medium) चा benchmark खर्च कमी आहे: $0.499 vs $0.533. GPT 5.3 Chat वेगवान आहे: 6.56s vs 143.55s, pass rates 59.1% vs 65.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-03

क्रमांक
#104
एकूण आउटपुट टोकन्स
390,873
प्रतिसाद वेळ (सरासरी)
143.55s
एकूण खर्च
$0.499
क्रमांक
#93
एकूण आउटपुट टोकन्स
28,179
प्रतिसाद वेळ (सरासरी)
6.56s
एकूण खर्च
$0.533
शिफारस केलेले मॉडेल GPT 5.3 Chat

It has the best score here (7.5), while responding about 21.9x faster than LongCat 2.0 (medium).

तपशीलवार तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 medium प्रकाशन: 2026-07-20 GPT 5.3 Chat GPT 5.3 Chat none प्रकाशन: 2026-03-03
स्कोअर 7.4 7.5
क्रमांक #104 #93
विश्वसनीयता 10.0 10.0
सुसंगतता 9.3 8.6
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 59.1% 65.2%
अस्थिर चाचण्या 2 4
एकूण रन 66 66
प्रति निकाल खर्च 4.153 4.097
एकूण खर्च $0.499 $0.533
इनपुट किंमत $0.300 / 1M $1.750 / 1M
आउटपुट किंमत $1.200 / 1M $14.000 / 1M
एकूण इनपुट टोकन्स 97,324 78,846
आउटपुट टोकन्स 44,383 28,179
रिझनिंग टोकन्स 346,490 0
प्रतिसाद वेळ (सरासरी) 143.55s 6.56s
प्रतिसाद वेळ (कमाल) 939.52s 18.33s
प्रतिसाद वेळ (एकूण) 3158.11s 137.77s
पॅरामीटर्स 1.6T एकूण (48B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 LongCat 2.0

medium
खर्च
$0.016
वेळ
285.1s
टोकन्स
13,057 tok

#93 GPT 5.3 Chat

none
खर्च
$0.008
वेळ
8.1s
टोकन्स
634 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

झटपट तुलना

तुलना जोडी बदला