नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.8 27B (low) vs GLM 5.2 (medium)

Qwen3.8 27B (low) average score मध्ये पुढे आहे: 7.9 vs 7.8. स्थानिक हार्डवेअरचा खर्च मोजला नाही, त्यामुळे खर्चाची तुलना उपलब्ध नाही. GLM 5.2 (medium) वेगवान आहे: 23.28s vs 39.11s, pass rates 68.2% vs 80.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#61
एकूण आउटपुट टोकन्स
169,329
प्रतिसाद वेळ (सरासरी)
39.11s
एकूण खर्च
लागू नाही
क्रमांक
#65
एकूण आउटपुट टोकन्स
61,761
प्रतिसाद वेळ (सरासरी)
23.28s
एकूण खर्च
$0.276
शिफारस केलेले मॉडेल GLM 5.2 (medium)

Its score stays close to the best score here (7.8 vs 7.9), while responding about 1.7x faster than Qwen3.8 27B (low).

तपशीलवार तुलना

मेट्रिक Qwen3.8 27B Qwen3.8 27B low प्रकाशन: 2026-08-14 GLM 5.2 GLM 5.2 medium प्रकाशन: 2026-06-17
स्कोअर 7.9 7.8
क्रमांक #61 #65
विश्वसनीयता 10.0 9.5
सुसंगतता 10.0 8.0
प्रयत्न 66/66 63/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 68.2% 80.3%
अस्थिर चाचण्या 0 4
एकूण रन 66 63
प्रति निकाल खर्च लागू नाही 2.159
एकूण खर्च लागू नाही $0.276
इनपुट किंमत लागू नाही $1.190 / 1M
आउटपुट किंमत लागू नाही $3.740 / 1M
एकूण इनपुट टोकन्स 99,705 37,199
आउटपुट टोकन्स 1,545 12,261
रिझनिंग टोकन्स 167,784 49,500
प्रतिसाद वेळ (सरासरी) 39.11s 23.28s
प्रतिसाद वेळ (कमाल) 376.04s 101.36s
प्रतिसाद वेळ (एकूण) 860.51s 488.94s
पॅरामीटर्स 27.3B 744B एकूण (40B सक्रिय)
उपलब्धता वेट्स उपलब्ध मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#61 Qwen3.8 27B

low
खर्च
लागू नाही
वेळ
92.8s
टोकन्स
6,902 tok

#65 GLM 5.2

medium
खर्च
$0.041
वेळ
195.8s
टोकन्स
9,287 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

झटपट तुलना

तुलना जोडी बदला

Qwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BlowGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsInklingmediumGPT-5.6 TerramediumvsQwen3.8 27BlowClaude Sonnet 4.6mediumvsQwen3.8 27BlowGPT-5.2 ChatnonevsGLM 5.2mediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumQwen3.7 FlashhighvsGLM 5.2medium