नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.6 27B vs GLM 5.1

average score जवळपास समान आहे: 5.5 vs 5.5. Qwen3.6 27B चा benchmark खर्च कमी आहे: $0.067 vs $0.164. GLM 5.1 वेगवान आहे: 6.70s vs 10.65s, pass rates 45.5% vs 40.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

क्रमांक
#164
एकूण आउटपुट टोकन्स
16,155
प्रतिसाद वेळ (सरासरी)
10.65s
एकूण खर्च
$0.067
क्रमांक
#163
एकूण आउटपुट टोकन्स
14,393
प्रतिसाद वेळ (सरासरी)
6.70s
एकूण खर्च
$0.164
शिफारस केलेले मॉडेल Qwen3.6 27B

It has the best score here (5.5), while costing about 2.5x less than GLM 5.1.

तपशीलवार तुलना

मेट्रिक Qwen3.6 27B Qwen3.6 27B none प्रकाशन: 2026-04-20 GLM 5.1 GLM 5.1 none प्रकाशन: 2026-04-07
स्कोअर 5.5 5.5
क्रमांक #164 #163
विश्वसनीयता 10.0 10.0
सुसंगतता 7.6 8.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 45.5% 40.9%
अस्थिर चाचण्या 6 5
एकूण रन 66 66
प्रति निकाल खर्च 1.220 2.368
एकूण खर्च $0.067 $0.164
इनपुट किंमत $0.290 / 1M $0.966 / 1M
आउटपुट किंमत $2.400 / 1M $3.036 / 1M
एकूण इनपुट टोकन्स 95,796 124,209
आउटपुट टोकन्स 16,155 14,393
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 10.65s 6.70s
प्रतिसाद वेळ (कमाल) 156.31s 61.20s
प्रतिसाद वेळ (एकूण) 234.39s 147.38s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Qwen3.6 27B

none
खर्च
$0.009
वेळ
83.0s
टोकन्स
4,549 tok

#163 GLM 5.1

none
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.6 27B 5.5 10.0 33.3% 0 4.16s 7,913 539 0
GLM 5.1 3.9 9.7 0.0% 0 4.96s 7,256 525 0

झटपट तुलना

तुलना जोडी बदला