नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.8 Flash Next (medium) vs GLM 5.1 (medium)

average score लगभग बराबर है: 7.6 vs 7.5. Qwen3.8 Flash Next (medium) की benchmark लागत कम है: ~$0.047 vs $1.546. Qwen3.8 Flash Next (medium) तेज है: 24.79s vs 66.38s, pass rates 75.4% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-05

तुलना किए गए मॉडल

रैंक
#119
कुल आउटपुट टोकन
143,965
प्रतिक्रिया समय (औसत)
24.79s
कुल लागत
~$0.047
रैंक
#123
कुल आउटपुट टोकन
248,708
प्रतिक्रिया समय (औसत)
66.38s
कुल लागत
$1.546
अनुशंसित मॉडल Qwen3.8 Flash Next (medium)

It has the best score here (7.6), while costing about 32.9x less than GLM 5.1 (medium).

विस्तृत तुलना

मेट्रिक Qwen3.8 Flash Next Qwen3.8 Flash Next medium रिलीज़: 2026-10-04 GLM 5.1 GLM 5.1 medium रिलीज़: 2026-04-07
स्कोर 7.6 7.5
रैंक #119 #123
विश्वसनीयता 10.0 9.2
संगति 7.9 8.4
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 75.4% 66.7%
अस्थिर टेस्ट 6 4
कुल रन 69 69
प्रति परिणाम लागत ~0.314 9.004
कुल लागत ~$0.047 $1.546
इनपुट कीमत लागू नहीं $1.400 / 1M
आउटपुट कीमत लागू नहीं $4.400 / 1M
कैश पढ़ने की कीमत लागू नहीं $0.260 / 1M
कैश लिखने की कीमत लागू नहीं लागू नहीं
कुल इनपुट टोकन 278,792 331,577
आउटपुट टोकन 1,695 17,919
रीजनिंग टोकन 142,270 230,789
प्रतिक्रिया समय (औसत) 24.79s 66.38s
प्रतिक्रिया समय (अधिकतम) 159.62s 308.75s
प्रतिक्रिया समय (कुल) 570.26s 1460.31s
पैरामीटर 180B कुल (6B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#119 Qwen3.8 Flash Next

medium
लागत
~$0.002
समय
40.7s
टोकन
4,059 tok

#123 GLM 5.1

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 45.53s 7,893 346 37,643
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

त्वरित तुलना

तुलना जोड़ी बदलें

GPT-6 LunalowvsQwen3.8 Flash NextmediumSpace Bunny AlphahighvsGLM 5.1mediumQwen3.8 Flash NextmediumvsSpace Bunny AlphahighQwen3.8 27Blowनिःशुल्क उपलब्धvsGLM 5.1mediumGPT-6 LunalowvsGLM 5.1mediumSeed-2.0-CodehighvsGLM 5.1mediumSeed-2.0-CodehighvsQwen3.8 Flash NextmediumDeepSeek V4 Flash 0731lowvsGLM 5.1mediumMuse Glimmer 30BhighvsQwen3.8 Flash NextmediumGPT-6 LunahighvsQwen3.8 Flash NextmediumGrok 4.7lowvsGLM 5.1mediumQwen3.7 FlashlowvsGLM 5.1medium