नेविगेशन
Advertise here

Qwen3.5-27B (medium) vs GLM 5.3 (high)

Qwen3.5-27B (medium) average score में आगे है: 7.9 vs 7.8. GLM 5.3 (high) की benchmark लागत कम है: $0.610 vs $1.135. GLM 5.3 (high) तेज है: 28.38s vs 114.73s, pass rates 76.8% vs 75.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#96
कुल आउटपुट टोकन
635,288
प्रतिक्रिया समय (औसत)
114.73s
कुल लागत
$1.135
रैंक
#105
कुल आउटपुट टोकन
68,482
प्रतिक्रिया समय (औसत)
28.38s
कुल लागत
$0.610
अनुशंसित मॉडल GLM 5.3 (high)

Its score stays close to the best score here (7.8 vs 7.9), while costing about 1.9x less than Qwen3.5-27B (medium).

विस्तृत तुलना

मेट्रिक Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24 GLM 5.3 GLM 5.3 high रिलीज़: 2026-08-20
स्कोर 7.9 7.8
रैंक #96 #105
विश्वसनीयता 10.0 10.0
संगति 7.9 7.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 76.8% 75.4%
अस्थिर टेस्ट 6 7
कुल रन 69 69
प्रति परिणाम लागत 8.104 4.351
कुल लागत $1.135 $0.610
इनपुट कीमत $0.195 / 1M $1.400 / 1M
आउटपुट कीमत $1.560 / 1M $4.400 / 1M
कुल इनपुट टोकन 288,919 219,811
आउटपुट टोकन 17,484 8,811
रीजनिंग टोकन 617,804 59,671
प्रतिक्रिया समय (औसत) 114.73s 28.38s
प्रतिक्रिया समय (अधिकतम) 1026.43s 159.91s
प्रतिक्रिया समय (कुल) 2638.74s 652.78s
पैरामीटर 27B 744B कुल (40B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

#105 GLM 5.3

high
लागत
$0.085
समय
362.5s
टोकन
19,310 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

त्वरित तुलना

तुलना जोड़ी बदलें