नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.8 27B (medium) vs GLM 5.2 (medium)

GLM 5.2 (medium) average score में आगे है: 7.8 vs 7.8. स्थानीय हार्डवेयर की लागत नहीं मापी गई, इसलिए लागत की तुलना उपलब्ध नहीं है। GLM 5.2 (medium) तेज है: 23.28s vs 33.05s, pass rates 66.7% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#68
कुल आउटपुट टोकन
136,162
प्रतिक्रिया समय (औसत)
33.05s
कुल लागत
लागू नहीं
रैंक
#65
कुल आउटपुट टोकन
61,761
प्रतिक्रिया समय (औसत)
23.28s
कुल लागत
$0.276
अनुशंसित मॉडल GLM 5.2 (medium)

It has the strongest score in this comparison (7.8) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Qwen3.8 27B Qwen3.8 27B medium रिलीज़: 2026-08-14 GLM 5.2 GLM 5.2 medium रिलीज़: 2026-06-17
स्कोर 7.8 7.8
रैंक #68 #65
विश्वसनीयता 9.6 9.5
संगति 9.7 8.0
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 66.7% 80.3%
अस्थिर टेस्ट 1 4
कुल रन 66 63
प्रति परिणाम लागत लागू नहीं 2.159
कुल लागत लागू नहीं $0.276
इनपुट कीमत लागू नहीं $1.190 / 1M
आउटपुट कीमत लागू नहीं $3.740 / 1M
कुल इनपुट टोकन 98,266 37,199
आउटपुट टोकन 1,861 12,261
रीजनिंग टोकन 134,301 49,500
प्रतिक्रिया समय (औसत) 33.05s 23.28s
प्रतिक्रिया समय (अधिकतम) 214.63s 101.36s
प्रतिक्रिया समय (कुल) 694.04s 488.94s
पैरामीटर 27.3B 744B कुल (40B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#68 Qwen3.8 27B

medium
लागत
लागू नहीं
समय
43.4s
टोकन
2,956 tok

#65 GLM 5.2

medium
लागत
$0.041
समय
195.8s
टोकन
9,287 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

त्वरित तुलना

तुलना जोड़ी बदलें

Claude Opus 4.8lowvsQwen3.8 27BmediumSeed-2.0-CodelowvsQwen3.8 27BmediumQwen3.8 27BlowvsGLM 5.2mediumGPT-5.2 ChatnonevsGLM 5.2mediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumQwen3.7 FlashhighvsGLM 5.2mediumGPT-5.6 TerrahighvsGLM 5.2mediumDeepSeek V4 ProhighvsQwen3.8 27BmediumSeed-2.0-CodelowvsGLM 5.2mediumGPT-5.2 ChatnonevsQwen3.8 27BmediumDeepSeek V4 Flash 0423highvsQwen3.8 27Bmedium