नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.7 Plus vs GLM 5.3 (high)

average score लगभग बराबर है: 7.3 vs 7.3. Qwen3.7 Plus की benchmark लागत कम है: $0.106 vs $0.403. Qwen3.7 Plus तेज है: 12.11s vs 27.82s, pass rates 54.6% vs 74.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#102
कुल आउटपुट टोकन
58,097
प्रतिक्रिया समय (औसत)
12.11s
कुल लागत
$0.106
रैंक
#99
कुल आउटपुट टोकन
63,667
प्रतिक्रिया समय (औसत)
27.82s
कुल लागत
$0.403
अनुशंसित मॉडल Qwen3.7 Plus

It has the best score here (7.3), while costing about 3.8x less than GLM 5.3 (high).

विस्तृत तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus none रिलीज़: 2026-06-03 GLM 5.3 GLM 5.3 high रिलीज़: 2026-08-20
स्कोर 7.3 7.3
रैंक #102 #99
विश्वसनीयता 10.0 10.0
संगति 10.0 7.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 54.6% 74.2%
अस्थिर टेस्ट 0 7
कुल रन 66 66
प्रति परिणाम लागत 0.930 3.099
कुल लागत $0.106 $0.403
इनपुट कीमत $0.320 / 1M $1.400 / 1M
आउटपुट कीमत $1.280 / 1M $4.400 / 1M
कुल इनपुट टोकन 98,833 87,601
आउटपुट टोकन 58,097 6,006
रीजनिंग टोकन 0 57,661
प्रतिक्रिया समय (औसत) 12.11s 27.82s
प्रतिक्रिया समय (अधिकतम) 206.03s 159.91s
प्रतिक्रिया समय (कुल) 266.40s 612.06s
पैरामीटर ~397B कुल (~17B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#102 Qwen3.7 Plus

none
लागत
$0.019
समय
213.5s
टोकन
11,960 tok

#99 GLM 5.3

high
लागत
$0.085
समय
362.5s
टोकन
19,310 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

त्वरित तुलना

तुलना जोड़ी बदलें