नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen: Qwen3.5-9B vs Z.ai: GLM 4.7 Flash

GLM 4.7 Flash (medium) average score में आगे है: 4.3 vs 3.8. Qwen3.5-9B (medium) की benchmark लागत कम है: $0.036 vs $0.166. Qwen3.5-9B (medium) तेज है: 82.24s vs 142.59s, pass rates 25.8% vs 31.8%.

अनुशंसित मॉडलGLM 4.7 Flash (medium)It has the strongest score in this comparison (4.3) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Qwen3.5-9B Qwen3.5-9B medium रिलीज़: 2026-03-02 GLM 4.7 Flash GLM 4.7 Flash medium रिलीज़: 2026-01-19
स्कोर 3.8 4.3
रैंक #220 #210
विश्वसनीयता 5.0 7.8
संगति 8.1 7.0
सही परीक्षण
प्रति प्रयास पास दर 25.8% 31.8%
अस्थिर टेस्ट 5 8
कुल रन 66 66
प्रति परिणाम लागत 1.187 4.147
कुल लागत $0.036 $0.166
इनपुट कीमत $0.100 / 1M $0.060 / 1M
आउटपुट कीमत $0.150 / 1M $0.400 / 1M
कुल इनपुट टोकन 17,070 79,051
आउटपुट टोकन 29,045 43,754
रीजनिंग टोकन 209,516 374,109
प्रतिक्रिया समय (औसत) 82.24s 142.59s
प्रतिक्रिया समय (अधिकतम) 226.38s 1539.97s
प्रतिक्रिया समय (कुल) 1315.88s 1996.21s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#220 Qwen3.5-9B

medium
लागत
$0.001
समय
35.9s
टोकन
3,030 tok

#210 GLM 4.7 Flash

medium
अमान्य SVG
लागत
$0.000
समय
186.2s
टोकन
12,112 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129
GLM 4.7 Flash 3.2 7.4 11.1% 1 55.33s 3,106 4,981 22,387

त्वरित तुलना

तुलना जोड़ी बदलें