नेविगेशन
AI BENCHY
Advertise here

Qwen3.7 Max vs GLM 5 (medium)

GLM 5 (medium) average score में आगे है: 7.7 vs 7.4. Qwen3.7 Max की benchmark लागत कम है: $0.197 vs $0.307. Qwen3.7 Max तेज है: 4.52s vs 33.54s, pass rates 68.2% vs 78.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#67
कुल आउटपुट टोकन
12,446
प्रतिक्रिया समय (औसत)
4.52s
कुल लागत
$0.197
रैंक
#49
कुल आउटपुट टोकन
124,566
प्रतिक्रिया समय (औसत)
33.54s
कुल लागत
$0.307
अनुशंसित मॉडल Qwen3.7 Max

Its score stays close to the best score here (7.4 vs 7.7), while costing about 1.6x less than GLM 5 (medium).

विस्तृत तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22 GLM 5 GLM 5 medium रिलीज़: 2026-02-12
स्कोर 7.4 7.7
रैंक #67 #49
विश्वसनीयता 9.9 10.0
संगति 10.0 8.1
सही परीक्षण
प्रति प्रयास पास दर 68.2% 78.8%
अस्थिर टेस्ट 0 4
कुल रन 66 63
प्रति परिणाम लागत 1.582 1.668
कुल लागत $0.197 $0.307
इनपुट कीमत $1.475 / 1M $0.950 / 1M
आउटपुट कीमत $4.425 / 1M $2.551 / 1M
कुल इनपुट टोकन 95,983 35,224
आउटपुट टोकन 12,446 21,570
रीजनिंग टोकन 0 102,996
प्रतिक्रिया समय (औसत) 4.52s 33.54s
प्रतिक्रिया समय (अधिकतम) 72.30s 99.85s
प्रतिक्रिया समय (कुल) 99.52s 435.99s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

#49 GLM 5

medium
लागत
$0.005
समय
20.7s
टोकन
2,068 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

त्वरित तुलना

तुलना जोड़ी बदलें