नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.5-27B (medium) vs GLM 5.2 (high)

GLM 5.2 (high) average score में आगे है: 8.0 vs 7.4. GLM 5.2 (high) की benchmark लागत कम है: $0.778 vs $0.981. GLM 5.2 (high) तेज है: 62.65s vs 111.94s, pass rates 72.7% vs 71.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-05

रैंक
#76
कुल आउटपुट टोकन
614,429
प्रतिक्रिया समय (औसत)
111.94s
कुल लागत
$0.981
रैंक
#45
कुल आउटपुट टोकन
295,347
प्रतिक्रिया समय (औसत)
62.65s
कुल लागत
$0.778
अनुशंसित मॉडल GLM 5.2 (high)

It has the best score here (8.0), while responding about 1.8x faster than Qwen3.5-27B (medium).

विस्तृत तुलना

मेट्रिक Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24 GLM 5.2 GLM 5.2 high रिलीज़: 2026-06-17
स्कोर 7.4 8.0
रैंक #76 #45
विश्वसनीयता 10.0 10.0
संगति 8.2 8.6
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 72.7% 71.2%
अस्थिर टेस्ट 5 3
कुल रन 66 66
प्रति परिणाम लागत 8.324 5.873
कुल लागत $0.981 $0.778
इनपुट कीमत $0.195 / 1M $0.760 / 1M
आउटपुट कीमत $1.560 / 1M $2.420 / 1M
कुल इनपुट टोकन 111,635 83,813
आउटपुट टोकन 15,999 69,688
रीजनिंग टोकन 598,430 225,659
प्रतिक्रिया समय (औसत) 111.94s 62.65s
प्रतिक्रिया समय (अधिकतम) 1026.43s 599.43s
प्रतिक्रिया समय (कुल) 2462.67s 1378.34s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#76 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

#45 GLM 5.2

high
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

त्वरित तुलना

तुलना जोड़ी बदलें