नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.2 vs Z.ai: GLM 5.2

GPT-5.2 (medium) average score में आगे है: 8.4 vs 8.0. GLM 5.2 (high) की benchmark लागत कम है: $0.296 vs $0.951. GPT-5.2 (medium) तेज है: 22.62s vs 62.65s, pass rates 72.7% vs 71.2%.

अनुशंसित मॉडलGPT-5.2 (medium)It has the best score here (8.4), while responding about 2.8x faster than GLM 5.2 (high).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-18

मेट्रिक GPT-5.2 GPT-5.2 medium रिलीज़: 2025-12-11 GLM 5.2 GLM 5.2 high रिलीज़: 2026-06-17
स्कोर 8.4 8.0
रैंक #21 #31
विश्वसनीयता 10.0 10.0
संगति 8.5 8.6
सही परीक्षण
प्रति प्रयास पास दर 72.7% 71.2%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 6.791 5.873
कुल लागत $0.951 $0.296
इनपुट कीमत $1.750 / 1M $0.293 / 1M
आउटपुट कीमत $14.000 / 1M $0.920 / 1M
कुल इनपुट टोकन 105,004 83,813
आउटपुट टोकन 9,914 69,688
रीजनिंग टोकन 44,868 225,659
प्रतिक्रिया समय (औसत) 22.62s 62.65s
प्रतिक्रिया समय (अधिकतम) 102.93s 599.43s
प्रतिक्रिया समय (कुल) 339.28s 1378.34s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#21 GPT-5.2

medium
लागत
$0.047
समय
49.2s
टोकन
3,396 tok

#31 GLM 5.2

high
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

त्वरित तुलना

तुलना जोड़ी बदलें