नेविगेशन
AI BENCHY
Advertise here

Qwen: Qwen3.6 Max Preview vs Z.ai: GLM 5.2

Qwen3.6 Max Preview (medium) average score में आगे है: 8.4 vs 8.0. GLM 5.2 (high) की benchmark लागत कम है: $0.296 vs $1.143. GLM 5.2 (high) तेज है: 62.65s vs 67.53s, pass rates 80.3% vs 71.2%.

अनुशंसित मॉडलGLM 5.2 (high)Its score stays close to the best score here (8.0 vs 8.4), while costing about 3.9x less than Qwen3.6 Max Preview (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-18

मेट्रिक Qwen3.6 Max Preview Qwen3.6 Max Preview medium रिलीज़: 2026-04-20 GLM 5.2 GLM 5.2 high रिलीज़: 2026-06-17
स्कोर 8.4 8.0
रैंक #19 #31
विश्वसनीयता 9.9 10.0
संगति 8.9 8.6
सही परीक्षण
प्रति प्रयास पास दर 80.3% 71.2%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 8.173 5.873
कुल लागत $1.143 $0.296
इनपुट कीमत $1.040 / 1M $0.293 / 1M
आउटपुट कीमत $6.240 / 1M $0.920 / 1M
कुल इनपुट टोकन 79,240 83,813
आउटपुट टोकन 5,098 69,688
रीजनिंग टोकन 164,842 225,659
प्रतिक्रिया समय (औसत) 67.53s 62.65s
प्रतिक्रिया समय (अधिकतम) 238.07s 599.43s
प्रतिक्रिया समय (कुल) 1485.64s 1378.34s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 Qwen3.6 Max Preview

medium
लागत
$0.024
समय
76.5s
टोकन
3,861 tok

#31 GLM 5.2

high
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

त्वरित तुलना

तुलना जोड़ी बदलें