नेव्हिगेशन
AI BENCHY
Advertise here

GPT 5.3 Chat vs GLM 5 (medium)

GLM 5 (medium) average score मध्ये पुढे आहे: 7.7 vs 7.5. GLM 5 (medium) चा benchmark खर्च कमी आहे: $0.228 vs $0.533. GPT 5.3 Chat वेगवान आहे: 6.56s vs 33.54s, pass rates 65.2% vs 78.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-20

क्रमांक
#85
एकूण आउटपुट टोकन्स
28,179
प्रतिसाद वेळ (सरासरी)
6.56s
एकूण खर्च
$0.533
क्रमांक
#72
एकूण आउटपुट टोकन्स
124,566
प्रतिसाद वेळ (सरासरी)
33.54s
एकूण खर्च
$0.228
शिफारस केलेले मॉडेल GLM 5 (medium)

It has the best score here (7.7), while costing about 2.3x less than GPT 5.3 Chat.

तपशीलवार तुलना

मेट्रिक GPT 5.3 Chat GPT 5.3 Chat none प्रकाशन: 2026-03-03 GLM 5 GLM 5 medium प्रकाशन: 2026-02-12
स्कोअर 7.5 7.7
क्रमांक #85 #72
विश्वसनीयता 10.0 10.0
सुसंगतता 8.6 8.1
प्रयत्न 66/66 63/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 78.8%
अस्थिर चाचण्या 4 4
एकूण रन 66 63
प्रति निकाल खर्च 4.097 1.668
एकूण खर्च $0.533 $0.228
इनपुट किंमत $1.750 / 1M $0.600 / 1M
आउटपुट किंमत $14.000 / 1M $1.920 / 1M
एकूण इनपुट टोकन्स 78,846 35,224
आउटपुट टोकन्स 28,179 21,570
रिझनिंग टोकन्स 0 102,996
प्रतिसाद वेळ (सरासरी) 6.56s 33.54s
प्रतिसाद वेळ (कमाल) 18.33s 99.85s
प्रतिसाद वेळ (एकूण) 137.77s 435.99s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#85 GPT 5.3 Chat

none
खर्च
$0.008
वेळ
8.1s
टोकन्स
634 tok

#72 GLM 5

medium
खर्च
$0.005
वेळ
20.7s
टोकन्स
2,068 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

झटपट तुलना

तुलना जोडी बदला