नेविगेशन
AI BENCHY
Advertise here

GPT-5.2 Chat vs GLM 5.2 (medium)

GPT-5.2 Chat average score में आगे है: 8.0 vs 7.8. GLM 5.2 (medium) की benchmark लागत कम है: $0.066 vs $0.604. GPT-5.2 Chat तेज है: 7.65s vs 23.28s, pass rates 74.2% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-02

रैंक
#39
कुल आउटपुट टोकन
30,424
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$0.604
रैंक
#49
कुल आउटपुट टोकन
61,761
प्रतिक्रिया समय (औसत)
23.28s
कुल लागत
$0.066
अनुशंसित मॉडल GLM 5.2 (medium)

Its score stays close to the best score here (7.8 vs 8.0), while costing about 9.2x less than GPT-5.2 Chat.

विस्तृत तुलना

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11 GLM 5.2 GLM 5.2 medium रिलीज़: 2026-06-17
स्कोर 8.0 7.8
रैंक #39 #49
विश्वसनीयता 10.0 9.5
संगति 8.6 8.0
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 21/22 टेस्ट · 63/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 74.2% 80.3%
अस्थिर टेस्ट 4 4
कुल रन 66 63
प्रति परिणाम लागत 4.308 2.159
कुल लागत $0.604 $0.066
इनपुट कीमत $1.750 / 1M $0.285 / 1M
आउटपुट कीमत $14.000 / 1M $0.894 / 1M
कुल इनपुट टोकन 101,248 37,199
आउटपुट टोकन 30,424 12,261
रीजनिंग टोकन 0 49,500
प्रतिक्रिया समय (औसत) 7.65s 23.28s
प्रतिक्रिया समय (अधिकतम) 38.52s 101.36s
प्रतिक्रिया समय (कुल) 168.39s 488.94s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#39 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

#49 GLM 5.2

medium
लागत
$0.041
समय
195.8s
टोकन
9,287 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

त्वरित तुलना

तुलना जोड़ी बदलें