नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.6 Plus (medium) vs GLM 5.2 (medium)

average score जवळपास समान आहे: 7.8 vs 7.8. GLM 5.2 (medium) चा benchmark खर्च कमी आहे: $0.176 vs $0.405. GLM 5.2 (medium) वेगवान आहे: 23.28s vs 43.12s, pass rates 71.2% vs 80.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-01

क्रमांक
#48
एकूण आउटपुट टोकन्स
191,237
प्रतिसाद वेळ (सरासरी)
43.12s
एकूण खर्च
$0.405
क्रमांक
#49
एकूण आउटपुट टोकन्स
61,761
प्रतिसाद वेळ (सरासरी)
23.28s
एकूण खर्च
$0.176
शिफारस केलेले मॉडेल GLM 5.2 (medium)

It has the best score here (7.8), while costing about 2.3x less than Qwen3.6 Plus (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.6 Plus Qwen3.6 Plus medium प्रकाशन: 2026-04-20 GLM 5.2 GLM 5.2 medium प्रकाशन: 2026-06-17
स्कोअर 7.8 7.8
क्रमांक #48 #49
विश्वसनीयता 10.0 9.5
सुसंगतता 9.3 8.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.2% 80.3%
अस्थिर चाचण्या 2 4
एकूण रन 66 63
प्रति निकाल खर्च 1.514 2.159
एकूण खर्च $0.405 $0.176
इनपुट किंमत $0.325 / 1M $0.761 / 1M
आउटपुट किंमत $1.950 / 1M $2.389 / 1M
एकूण इनपुट टोकन्स 97,689 37,199
आउटपुट टोकन्स 6,412 12,261
रिझनिंग टोकन्स 184,825 49,500
प्रतिसाद वेळ (सरासरी) 43.12s 23.28s
प्रतिसाद वेळ (कमाल) 291.55s 101.36s
प्रतिसाद वेळ (एकूण) 905.53s 488.94s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#48 Qwen3.6 Plus

medium
खर्च
$0.024
वेळ
219.0s
टोकन्स
12,235 tok

#49 GLM 5.2

medium
खर्च
$0.041
वेळ
195.8s
टोकन्स
9,287 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.6 Plus 6.1 7.8 44.4% 1 153.12s 7,098 58 50,586
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

झटपट तुलना

तुलना जोडी बदला