नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.8 27B (low) vs GLM 5.2 (medium)

Qwen3.8 27B (low) average score में आगे है: 7.9 vs 7.8. स्थानीय हार्डवेयर की लागत नहीं मापी गई, इसलिए लागत की तुलना उपलब्ध नहीं है। GLM 5.2 (medium) तेज है: 23.28s vs 39.11s, pass rates 68.2% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#61
कुल आउटपुट टोकन
169,329
प्रतिक्रिया समय (औसत)
39.11s
कुल लागत
लागू नहीं
रैंक
#65
कुल आउटपुट टोकन
61,761
प्रतिक्रिया समय (औसत)
23.28s
कुल लागत
$0.276
अनुशंसित मॉडल GLM 5.2 (medium)

Its score stays close to the best score here (7.8 vs 7.9), while responding about 1.7x faster than Qwen3.8 27B (low).

विस्तृत तुलना

मेट्रिक Qwen3.8 27B Qwen3.8 27B low रिलीज़: 2026-08-14 GLM 5.2 GLM 5.2 medium रिलीज़: 2026-06-17
स्कोर 7.9 7.8
रैंक #61 #65
विश्वसनीयता 10.0 9.5
संगति 10.0 8.0
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 80.3%
अस्थिर टेस्ट 0 4
कुल रन 66 63
प्रति परिणाम लागत लागू नहीं 2.159
कुल लागत लागू नहीं $0.276
इनपुट कीमत लागू नहीं $1.190 / 1M
आउटपुट कीमत लागू नहीं $3.740 / 1M
कुल इनपुट टोकन 99,705 37,199
आउटपुट टोकन 1,545 12,261
रीजनिंग टोकन 167,784 49,500
प्रतिक्रिया समय (औसत) 39.11s 23.28s
प्रतिक्रिया समय (अधिकतम) 376.04s 101.36s
प्रतिक्रिया समय (कुल) 860.51s 488.94s
पैरामीटर 27.3B 744B कुल (40B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#61 Qwen3.8 27B

low
लागत
लागू नहीं
समय
92.8s
टोकन
6,902 tok

#65 GLM 5.2

medium
लागत
$0.041
समय
195.8s
टोकन
9,287 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

त्वरित तुलना

तुलना जोड़ी बदलें

Qwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BlowGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsInklingmediumGPT-5.6 TerramediumvsQwen3.8 27BlowClaude Sonnet 4.6mediumvsQwen3.8 27BlowGPT-5.2 ChatnonevsGLM 5.2mediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumQwen3.7 FlashhighvsGLM 5.2medium