नेविगेशन
Advertise here

Qwen3.7 Flash (high) vs GLM 5 (medium)

average score लगभग बराबर है: 7.8 vs 7.7. Qwen3.7 Flash (high) की benchmark लागत कम है: $0.052 vs $0.228. GLM 5 (medium) तेज है: 33.54s vs 41.37s, pass rates 71.2% vs 78.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#91
कुल आउटपुट टोकन
370,250
प्रतिक्रिया समय (औसत)
41.37s
कुल लागत
$0.052
रैंक
#92
कुल आउटपुट टोकन
124,566
प्रतिक्रिया समय (औसत)
33.54s
कुल लागत
$0.228
अनुशंसित मॉडल Qwen3.7 Flash (high)

It has the best score here (7.8), while costing about 4.4x less than GLM 5 (medium).

विस्तृत तुलना

मेट्रिक Qwen3.7 Flash Qwen3.7 Flash high रिलीज़: 2026-07-28 GLM 5 GLM 5 medium रिलीज़: 2026-02-12
स्कोर 7.8 7.7
रैंक #91 #92
विश्वसनीयता 10.0 10.0
संगति 7.8 8.1
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 71.2% 78.8%
अस्थिर टेस्ट 6 4
कुल रन 66 63
प्रति परिणाम लागत 0.398 1.668
कुल लागत $0.052 $0.228
इनपुट कीमत $0.030 / 1M $0.600 / 1M
आउटपुट कीमत $0.130 / 1M $1.920 / 1M
कुल इनपुट टोकन 116,331 35,224
आउटपुट टोकन 12,330 21,570
रीजनिंग टोकन 357,920 102,996
प्रतिक्रिया समय (औसत) 41.37s 33.54s
प्रतिक्रिया समय (अधिकतम) 431.47s 99.85s
प्रतिक्रिया समय (कुल) 910.11s 435.99s
पैरामीटर ~35B कुल (~3B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 Qwen3.7 Flash

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
लागत
$0.000
समय
600.0s
टोकन
0 tok

#92 GLM 5

medium
लागत
$0.005
समय
20.7s
टोकन
2,068 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Flash 8.2 9.7 66.7% 0 58.84s 7,893 503 62,350
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

त्वरित तुलना

तुलना जोड़ी बदलें