नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen: Qwen3.6 Max Preview vs Z.ai: GLM 5.2

Qwen3.6 Max Preview (medium) average score मध्ये पुढे आहे: 8.4 vs 8.0. GLM 5.2 (high) चा benchmark खर्च कमी आहे: $0.970 vs $1.143. GLM 5.2 (high) वेगवान आहे: 62.65s vs 67.53s, pass rates 80.3% vs 71.2%.

शिफारस केलेले मॉडेलQwen3.6 Max Preview (medium)It has the strongest score in this comparison (8.4) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-20

मेट्रिक Qwen3.6 Max Preview Qwen3.6 Max Preview medium प्रकाशन: 2026-04-20 GLM 5.2 GLM 5.2 high प्रकाशन: 2026-06-17
स्कोअर 8.4 8.0
क्रमांक #19 #31
विश्वसनीयता 9.9 10.0
सुसंगतता 8.9 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 80.3% 71.2%
अस्थिर चाचण्या 3 3
एकूण रन 66 66
प्रति निकाल खर्च 8.173 5.873
एकूण खर्च $1.143 $0.970
इनपुट किंमत $1.040 / 1M $0.960 / 1M
आउटपुट किंमत $6.240 / 1M $3.014 / 1M
एकूण इनपुट टोकन्स 79,240 83,813
आउटपुट टोकन्स 5,098 69,688
रिझनिंग टोकन्स 164,842 225,659
प्रतिसाद वेळ (सरासरी) 67.53s 62.65s
प्रतिसाद वेळ (कमाल) 238.07s 599.43s
प्रतिसाद वेळ (एकूण) 1485.64s 1378.34s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 Qwen3.6 Max Preview

medium
खर्च
$0.024
वेळ
76.5s
टोकन्स
3,861 tok

#31 GLM 5.2

high
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

झटपट तुलना

तुलना जोडी बदला