नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.8 27B (low) vs GLM 5.2 (high)

GLM 5.2 (high) average score मध्ये पुढे आहे: 8.0 vs 7.9. स्थानिक हार्डवेअरचा खर्च मोजला नाही, त्यामुळे खर्चाची तुलना उपलब्ध नाही. Qwen3.8 27B (low) वेगवान आहे: 39.11s vs 69.86s, pass rates 68.2% vs 69.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#61
एकूण आउटपुट टोकन्स
169,329
प्रतिसाद वेळ (सरासरी)
39.11s
एकूण खर्च
लागू नाही
क्रमांक
#55
एकूण आउटपुट टोकन्स
364,655
प्रतिसाद वेळ (सरासरी)
69.86s
एकूण खर्च
$1.463
शिफारस केलेले मॉडेल GLM 5.2 (high)

It has the strongest score in this comparison (8.0) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक Qwen3.8 27B Qwen3.8 27B low प्रकाशन: 2026-08-14 GLM 5.2 GLM 5.2 high प्रकाशन: 2026-06-17
स्कोअर 7.9 8.0
क्रमांक #61 #55
विश्वसनीयता 10.0 10.0
सुसंगतता 10.0 8.6
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 68.2% 69.7%
अस्थिर चाचण्या 0 3
एकूण रन 66 66
प्रति निकाल खर्च लागू नाही 6.849
एकूण खर्च लागू नाही $1.463
इनपुट किंमत लागू नाही $1.190 / 1M
आउटपुट किंमत लागू नाही $3.740 / 1M
एकूण इनपुट टोकन्स 99,705 83,822
आउटपुट टोकन्स 1,545 72,040
रिझनिंग टोकन्स 167,784 292,615
प्रतिसाद वेळ (सरासरी) 39.11s 69.86s
प्रतिसाद वेळ (कमाल) 376.04s 599.43s
प्रतिसाद वेळ (एकूण) 860.51s 1536.98s
पॅरामीटर्स 27.3B 744B एकूण (40B सक्रिय)
उपलब्धता वेट्स उपलब्ध मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#61 Qwen3.8 27B

low
खर्च
लागू नाही
वेळ
92.8s
टोकन्स
6,902 tok

#55 GLM 5.2

high
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

झटपट तुलना

तुलना जोडी बदला

Qwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BlowDeepSeek V4 Flash 0731lowvsGLM 5.2highInklingmediumvsGLM 5.2highGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2mediumQwen3.8 27BlowvsInklingmediumGPT-5.6 TerramediumvsQwen3.8 27BlowClaude Sonnet 4.6mediumvsQwen3.8 27BlowKimi K3maxvsGLM 5.2high