नेविगेशन
AI BENCHY
Advertise here

Qwen3.6 Plus (medium) vs GLM 5.2 (medium)

average score लगभग बराबर है: 7.8 vs 7.8. GLM 5.2 (medium) की benchmark लागत कम है: $0.176 vs $0.405. GLM 5.2 (medium) तेज है: 23.28s vs 43.12s, pass rates 71.2% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-01

रैंक
#48
कुल आउटपुट टोकन
191,237
प्रतिक्रिया समय (औसत)
43.12s
कुल लागत
$0.405
रैंक
#49
कुल आउटपुट टोकन
61,761
प्रतिक्रिया समय (औसत)
23.28s
कुल लागत
$0.176
अनुशंसित मॉडल GLM 5.2 (medium)

It has the best score here (7.8), while costing about 2.3x less than Qwen3.6 Plus (medium).

विस्तृत तुलना

मेट्रिक Qwen3.6 Plus Qwen3.6 Plus medium रिलीज़: 2026-04-20 GLM 5.2 GLM 5.2 medium रिलीज़: 2026-06-17
स्कोर 7.8 7.8
रैंक #48 #49
विश्वसनीयता 10.0 9.5
संगति 9.3 8.0
सही परीक्षण
प्रति प्रयास पास दर 71.2% 80.3%
अस्थिर टेस्ट 2 4
कुल रन 66 63
प्रति परिणाम लागत 1.514 2.159
कुल लागत $0.405 $0.176
इनपुट कीमत $0.325 / 1M $0.761 / 1M
आउटपुट कीमत $1.950 / 1M $2.389 / 1M
कुल इनपुट टोकन 97,689 37,199
आउटपुट टोकन 6,412 12,261
रीजनिंग टोकन 184,825 49,500
प्रतिक्रिया समय (औसत) 43.12s 23.28s
प्रतिक्रिया समय (अधिकतम) 291.55s 101.36s
प्रतिक्रिया समय (कुल) 905.53s 488.94s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#48 Qwen3.6 Plus

medium
लागत
$0.024
समय
219.0s
टोकन
12,235 tok

#49 GLM 5.2

medium
लागत
$0.041
समय
195.8s
टोकन
9,287 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Plus 6.1 7.8 44.4% 1 153.12s 7,098 58 50,586
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

त्वरित तुलना

तुलना जोड़ी बदलें