नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.8 27B (low) vs GLM 5 (medium)

Qwen3.8 27B (low) average score मध्ये पुढे आहे: 7.9 vs 7.7. Qwen3.8 27B (low) चा benchmark खर्च कमी आहे: ~$0.071 vs $0.228. GLM 5 (medium) वेगवान आहे: 33.54s vs 39.11s, pass rates 68.2% vs 78.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-20

क्रमांक
#61
एकूण आउटपुट टोकन्स
169,329
प्रतिसाद वेळ (सरासरी)
39.11s
एकूण खर्च
~$0.071
क्रमांक
#72
एकूण आउटपुट टोकन्स
124,566
प्रतिसाद वेळ (सरासरी)
33.54s
एकूण खर्च
$0.228
शिफारस केलेले मॉडेल Qwen3.8 27B (low)

It has the best score here (7.9), while costing about 3.2x less than GLM 5 (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.8 27B Qwen3.8 27B low प्रकाशन: 2026-08-14 GLM 5 GLM 5 medium प्रकाशन: 2026-02-12
स्कोअर 7.9 7.7
क्रमांक #61 #72
विश्वसनीयता 10.0 10.0
सुसंगतता 10.0 8.1
प्रयत्न 66/66 63/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 68.2% 78.8%
अस्थिर चाचण्या 0 4
एकूण रन 66 63
प्रति निकाल खर्च ~0.473 1.668
एकूण खर्च ~$0.071 $0.228
इनपुट किंमत लागू नाही $0.600 / 1M
आउटपुट किंमत लागू नाही $1.920 / 1M
एकूण इनपुट टोकन्स 99,705 35,224
आउटपुट टोकन्स 1,545 21,570
रिझनिंग टोकन्स 167,784 102,996
प्रतिसाद वेळ (सरासरी) 39.11s 33.54s
प्रतिसाद वेळ (कमाल) 376.04s 99.85s
प्रतिसाद वेळ (एकूण) 860.51s 435.99s
पॅरामीटर्स 27.3B 744B एकूण (40B सक्रिय)
उपलब्धता वेट्स उपलब्ध मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#61 Qwen3.8 27B

low
खर्च
~$0.003
वेळ
92.8s
टोकन्स
6,902 tok

#72 GLM 5

medium
खर्च
$0.005
वेळ
20.7s
टोकन्स
2,068 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

झटपट तुलना

तुलना जोडी बदला

Seed-2.0-CodelowvsGLM 5mediumQwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BlowQwen3.7 FlashhighvsGLM 5mediumClaude Opus 4.8lowvsGLM 5mediumGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2mediumQwen3.8 27BlowvsInklingmediumDeepSeek V4 ProhighvsGLM 5mediumGPT-5.6 TerramediumvsQwen3.8 27Blow