नेविगेशन
AI BENCHY
Advertise here

Qwen: Qwen3.6 Max Preview vs Z.ai: GLM 5.2

average score लगभग बराबर है: 6.6 vs 6.6. GLM 5.2 की benchmark लागत कम है: $0.125 vs $0.231. Qwen3.6 Max Preview तेज है: 7.82s vs 9.34s, pass rates 60.6% vs 59.1%.

अनुशंसित मॉडलGLM 5.2It has the best score here (6.6), while costing about 1.8x less than Qwen3.6 Max Preview.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Qwen3.6 Max Preview Qwen3.6 Max Preview none रिलीज़: 2026-04-20 GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 6.6 6.6
रैंक #107 #105
विश्वसनीयता 9.9 10.0
संगति 9.3 9.2
सही परीक्षण
प्रति प्रयास पास दर 60.6% 59.1%
अस्थिर टेस्ट 2 2
कुल रन 66 64
प्रति परिणाम लागत 2.061 1.421
कुल लागत $0.231 $0.125
इनपुट कीमत $1.040 / 1M $0.793 / 1M
आउटपुट कीमत $6.240 / 1M $2.491 / 1M
कुल इनपुट टोकन 106,339 112,359
आउटपुट टोकन 19,257 14,340
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 7.82s 9.34s
प्रतिक्रिया समय (अधिकतम) 102.62s 79.65s
प्रतिक्रिया समय (कुल) 172.01s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#107 Qwen3.6 Max Preview

none
लागत
$0.025
समय
83.9s
टोकन
4,066 tok

#105 GLM 5.2

none
अमान्य SVG
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 3.8 7.3 22.2% 1 3.12s 7,913 456 0
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

त्वरित तुलना

तुलना जोड़ी बदलें