नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.8 27B (medium) vs GLM 5.2 (medium)

GLM 5.2 (medium) average score मध्ये पुढे आहे: 7.8 vs 7.8. स्थानिक हार्डवेअरचा खर्च मोजला नाही, त्यामुळे खर्चाची तुलना उपलब्ध नाही. GLM 5.2 (medium) वेगवान आहे: 23.28s vs 33.05s, pass rates 66.7% vs 80.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#68
एकूण आउटपुट टोकन्स
136,162
प्रतिसाद वेळ (सरासरी)
33.05s
एकूण खर्च
लागू नाही
क्रमांक
#65
एकूण आउटपुट टोकन्स
61,761
प्रतिसाद वेळ (सरासरी)
23.28s
एकूण खर्च
$0.276
शिफारस केलेले मॉडेल GLM 5.2 (medium)

It has the strongest score in this comparison (7.8) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक Qwen3.8 27B Qwen3.8 27B medium प्रकाशन: 2026-08-14 GLM 5.2 GLM 5.2 medium प्रकाशन: 2026-06-17
स्कोअर 7.8 7.8
क्रमांक #68 #65
विश्वसनीयता 9.6 9.5
सुसंगतता 9.7 8.0
प्रयत्न 66/66 63/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 66.7% 80.3%
अस्थिर चाचण्या 1 4
एकूण रन 66 63
प्रति निकाल खर्च लागू नाही 2.159
एकूण खर्च लागू नाही $0.276
इनपुट किंमत लागू नाही $1.190 / 1M
आउटपुट किंमत लागू नाही $3.740 / 1M
एकूण इनपुट टोकन्स 98,266 37,199
आउटपुट टोकन्स 1,861 12,261
रिझनिंग टोकन्स 134,301 49,500
प्रतिसाद वेळ (सरासरी) 33.05s 23.28s
प्रतिसाद वेळ (कमाल) 214.63s 101.36s
प्रतिसाद वेळ (एकूण) 694.04s 488.94s
पॅरामीटर्स 27.3B 744B एकूण (40B सक्रिय)
उपलब्धता वेट्स उपलब्ध मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#68 Qwen3.8 27B

medium
खर्च
लागू नाही
वेळ
43.4s
टोकन्स
2,956 tok

#65 GLM 5.2

medium
खर्च
$0.041
वेळ
195.8s
टोकन्स
9,287 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

झटपट तुलना

तुलना जोडी बदला

Claude Opus 4.8lowvsQwen3.8 27BmediumSeed-2.0-CodelowvsQwen3.8 27BmediumQwen3.8 27BlowvsGLM 5.2mediumGPT-5.2 ChatnonevsGLM 5.2mediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumQwen3.7 FlashhighvsGLM 5.2mediumGPT-5.6 TerrahighvsGLM 5.2mediumDeepSeek V4 ProhighvsQwen3.8 27BmediumSeed-2.0-CodelowvsGLM 5.2mediumGPT-5.2 ChatnonevsQwen3.8 27BmediumDeepSeek V4 Flash 0423highvsQwen3.8 27Bmedium