नेविगेशन
Advertise here

Qwen3.7 Max vs GLM 5.3 (high)

Qwen3.7 Max average score में आगे है: 7.9 vs 7.8. Qwen3.7 Max की benchmark लागत कम है: $0.492 vs $0.610. Qwen3.7 Max तेज है: 7.85s vs 28.38s, pass rates 69.6% vs 75.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#100
कुल आउटपुट टोकन
20,670
प्रतिक्रिया समय (औसत)
7.85s
कुल लागत
$0.492
रैंक
#105
कुल आउटपुट टोकन
68,482
प्रतिक्रिया समय (औसत)
28.38s
कुल लागत
$0.610
अनुशंसित मॉडल Qwen3.7 Max

It has the best score here (7.9), while responding about 3.6x faster than GLM 5.3 (high).

विस्तृत तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22 GLM 5.3 GLM 5.3 high रिलीज़: 2026-08-20
स्कोर 7.9 7.8
रैंक #100 #105
विश्वसनीयता 9.9 10.0
संगति 10.0 7.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 69.6% 75.4%
अस्थिर टेस्ट 0 7
कुल रन 69 69
प्रति परिणाम लागत 3.070 4.351
कुल लागत $0.492 $0.610
इनपुट कीमत $1.475 / 1M $1.400 / 1M
आउटपुट कीमत $4.425 / 1M $4.400 / 1M
कुल इनपुट टोकन 243,553 219,811
आउटपुट टोकन 20,670 8,811
रीजनिंग टोकन 0 59,671
प्रतिक्रिया समय (औसत) 7.85s 28.38s
प्रतिक्रिया समय (अधिकतम) 80.34s 159.91s
प्रतिक्रिया समय (कुल) 180.65s 652.78s
पैरामीटर ~1T कुल (~40B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#100 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

#105 GLM 5.3

high
लागत
$0.085
समय
362.5s
टोकन
19,310 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

त्वरित तुलना

तुलना जोड़ी बदलें