नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen: Qwen3.5 Plus 2026-04-20 vs Z.ai: GLM 5

Qwen3.5 Plus 2026-04-20 average score में आगे है: 6.1 vs 5.7. GLM 5 की benchmark लागत कम है: $0.041 vs $0.122. GLM 5 तेज है: 4.03s vs 13.56s, pass rates 43.9% vs 42.4%.

अनुशंसित मॉडलGLM 5Its score stays close to the best score here (5.7 vs 6.1), while costing about 3.0x less than Qwen3.5 Plus 2026-04-20.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none रिलीज़: 2026-04-20 GLM 5 GLM 5 none रिलीज़: 2026-02-12
स्कोर 6.1 5.7
रैंक #137 #152
विश्वसनीयता 10.0 10.0
संगति 8.7 9.3
सही परीक्षण
प्रति प्रयास पास दर 43.9% 42.4%
अस्थिर टेस्ट 4 1
कुल रन 66 63
प्रति परिणाम लागत 1.636 0.263
कुल लागत $0.122 $0.041
इनपुट कीमत $0.300 / 1M $0.950 / 1M
आउटपुट कीमत $1.800 / 1M $2.551 / 1M
कुल इनपुट टोकन 94,468 37,135
आउटपुट टोकन 51,487 1,989
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 13.56s 4.03s
प्रतिक्रिया समय (अधिकतम) 206.05s 11.07s
प्रतिक्रिया समय (कुल) 298.31s 56.37s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#137 Qwen3.5 Plus 2026-04-20

none
लागत
$0.008
समय
77.0s
टोकन
4,369 tok

#152 GLM 5

none
लागत
$0.007
समय
32.1s
टोकन
2,023 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5 Plus 2026-04-20 3.9 7.8 11.1% 1 1.69s 7,913 480 0
GLM 5 4.0 7.8 11.1% 1 5.12s 7,256 428 0

त्वरित तुलना

तुलना जोड़ी बदलें