नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.8 27B (medium) vs GLM 5 (medium)

Qwen3.8 27B (medium) average score मध्ये पुढे आहे: 7.8 vs 7.7. स्थानिक हार्डवेअरचा खर्च मोजला नाही, त्यामुळे खर्चाची तुलना उपलब्ध नाही. Qwen3.8 27B (medium) वेगवान आहे: 33.05s vs 33.54s, pass rates 66.7% vs 78.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#68
एकूण आउटपुट टोकन्स
136,162
प्रतिसाद वेळ (सरासरी)
33.05s
एकूण खर्च
लागू नाही
क्रमांक
#72
एकूण आउटपुट टोकन्स
124,566
प्रतिसाद वेळ (सरासरी)
33.54s
एकूण खर्च
$0.307
शिफारस केलेले मॉडेल GLM 5 (medium)

It has the best overall balance of score, reliability, cost, and response time in this comparison.

तपशीलवार तुलना

मेट्रिक Qwen3.8 27B Qwen3.8 27B medium प्रकाशन: 2026-08-14 GLM 5 GLM 5 medium प्रकाशन: 2026-02-12
स्कोअर 7.8 7.7
क्रमांक #68 #72
विश्वसनीयता 9.6 10.0
सुसंगतता 9.7 8.1
प्रयत्न 66/66 63/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 66.7% 78.8%
अस्थिर चाचण्या 1 4
एकूण रन 66 63
प्रति निकाल खर्च लागू नाही 1.668
एकूण खर्च लागू नाही $0.307
इनपुट किंमत लागू नाही $0.950 / 1M
आउटपुट किंमत लागू नाही $2.551 / 1M
एकूण इनपुट टोकन्स 98,266 35,224
आउटपुट टोकन्स 1,861 21,570
रिझनिंग टोकन्स 134,301 102,996
प्रतिसाद वेळ (सरासरी) 33.05s 33.54s
प्रतिसाद वेळ (कमाल) 214.63s 99.85s
प्रतिसाद वेळ (एकूण) 694.04s 435.99s
पॅरामीटर्स 27.3B 744B एकूण (40B सक्रिय)
उपलब्धता वेट्स उपलब्ध मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#68 Qwen3.8 27B

medium
खर्च
लागू नाही
वेळ
43.4s
टोकन्स
2,956 tok

#72 GLM 5

medium
खर्च
$0.005
वेळ
20.7s
टोकन्स
2,068 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

झटपट तुलना

तुलना जोडी बदला

Seed-2.0-CodelowvsGLM 5mediumClaude Opus 4.8lowvsQwen3.8 27BmediumQwen3.7 FlashhighvsGLM 5mediumClaude Opus 4.8lowvsGLM 5mediumSeed-2.0-CodelowvsQwen3.8 27BmediumDeepSeek V4 ProhighvsGLM 5mediumDeepSeek V4 Flash 0423highvsGLM 5mediumDeepSeek V4 ProhighvsQwen3.8 27BmediumGPT-5.2 ChatnonevsQwen3.8 27BmediumDeepSeek V4 Flash 0423highvsQwen3.8 27BmediumKimi K3maxvsQwen3.8 27BmediumGPT-5.6 LunahighvsGLM 5medium