नेविगेशन
AI BENCHY
Advertise here

GPT 5.3 Chat vs GLM 5 (medium)

GLM 5 (medium) average score में आगे है: 7.7 vs 7.5. GLM 5 (medium) की benchmark लागत कम है: $0.228 vs $0.533. GPT 5.3 Chat तेज है: 6.56s vs 33.54s, pass rates 65.2% vs 78.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#85
कुल आउटपुट टोकन
28,179
प्रतिक्रिया समय (औसत)
6.56s
कुल लागत
$0.533
रैंक
#72
कुल आउटपुट टोकन
124,566
प्रतिक्रिया समय (औसत)
33.54s
कुल लागत
$0.228
अनुशंसित मॉडल GLM 5 (medium)

It has the best score here (7.7), while costing about 2.3x less than GPT 5.3 Chat.

विस्तृत तुलना

मेट्रिक GPT 5.3 Chat GPT 5.3 Chat none रिलीज़: 2026-03-03 GLM 5 GLM 5 medium रिलीज़: 2026-02-12
स्कोर 7.5 7.7
रैंक #85 #72
विश्वसनीयता 10.0 10.0
संगति 8.6 8.1
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 78.8%
अस्थिर टेस्ट 4 4
कुल रन 66 63
प्रति परिणाम लागत 4.097 1.668
कुल लागत $0.533 $0.228
इनपुट कीमत $1.750 / 1M $0.600 / 1M
आउटपुट कीमत $14.000 / 1M $1.920 / 1M
कुल इनपुट टोकन 78,846 35,224
आउटपुट टोकन 28,179 21,570
रीजनिंग टोकन 0 102,996
प्रतिक्रिया समय (औसत) 6.56s 33.54s
प्रतिक्रिया समय (अधिकतम) 18.33s 99.85s
प्रतिक्रिया समय (कुल) 137.77s 435.99s
पैरामीटर ~400B कुल (~17B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#85 GPT 5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

#72 GLM 5

medium
लागत
$0.005
समय
20.7s
टोकन
2,068 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

त्वरित तुलना

तुलना जोड़ी बदलें