नेविगेशन
Advertise here

Qwen3.6 35B A3B (medium) vs GLM 5.3 (low)

average score लगभग बराबर है: 6.5 vs 6.5. GLM 5.3 (low) की benchmark लागत कम है: $0.473 vs $0.812. GLM 5.3 (low) तेज है: 15.28s vs 59.92s, pass rates 58.0% vs 63.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#192
कुल आउटपुट टोकन
776,174
प्रतिक्रिया समय (औसत)
59.92s
कुल लागत
$0.812
रैंक
#195
कुल आउटपुट टोकन
28,602
प्रतिक्रिया समय (औसत)
15.28s
कुल लागत
$0.473
अनुशंसित मॉडल GLM 5.3 (low)

It has the best score here (6.5), while costing about 1.7x less than Qwen3.6 35B A3B (medium).

विस्तृत तुलना

मेट्रिक Qwen3.6 35B A3B Qwen3.6 35B A3B medium रिलीज़: 2026-04-20 GLM 5.3 GLM 5.3 low रिलीज़: 2026-08-20
स्कोर 6.5 6.5
रैंक #192 #195
विश्वसनीयता 10.0 10.0
संगति 9.0 8.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 58.0% 63.8%
अस्थिर टेस्ट 3 5
कुल रन 69 69
प्रति परिणाम लागत 6.732 3.936
कुल लागत $0.812 $0.473
इनपुट कीमत $0.150 / 1M $1.400 / 1M
आउटपुट कीमत $1.000 / 1M $4.400 / 1M
कुल इनपुट टोकन 282,192 247,436
आउटपुट टोकन 75,306 11,005
रीजनिंग टोकन 700,868 17,597
प्रतिक्रिया समय (औसत) 59.92s 15.28s
प्रतिक्रिया समय (अधिकतम) 817.57s 83.60s
प्रतिक्रिया समय (कुल) 1258.32s 351.49s
पैरामीटर 35B कुल (3B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#192 Qwen3.6 35B A3B

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

#195 GLM 5.3

low
लागत
$0.007
समय
28.4s
टोकन
1,599 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 35B A3B 7.7 10.0 66.7% 0 50.55s 5,051 7,929 37,223
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

त्वरित तुलना

तुलना जोड़ी बदलें