نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen: Qwen3.5-9B vs Z.ai: GLM 4.7 Flash

GLM 4.7 Flash (medium) average score میں آگے ہے: 4.3 vs 3.8. Qwen3.5-9B (medium) کی benchmark لاگت کم ہے: $0.036 vs $0.166. Qwen3.5-9B (medium) تیز ہے: 82.24s vs 142.59s، pass rates 25.8% vs 31.8%.

تجویز کردہ ماڈلGLM 4.7 Flash (medium)It has the strongest score in this comparison (4.3) and the best overall balance of cost and response time across all 2 models.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-25

میٹرک Qwen3.5-9B Qwen3.5-9B medium اجرا: 2026-03-02 GLM 4.7 Flash GLM 4.7 Flash medium اجرا: 2026-01-19
اسکور 3.8 4.3
درجہ #220 #210
اعتماد پذیری 5.0 7.8
تسلسل 8.1 7.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 25.8% 31.8%
غیر مستحکم ٹیسٹ 5 8
کل رنز 66 66
فی نتیجہ لاگت 1.187 4.147
کل لاگت $0.036 $0.166
ان پٹ قیمت $0.100 / 1M $0.060 / 1M
آؤٹ پٹ قیمت $0.150 / 1M $0.400 / 1M
کل ان پٹ ٹوکنز 17,070 79,051
آؤٹ پٹ ٹوکنز 29,045 43,754
ریزننگ ٹوکنز 209,516 374,109
ردِعمل کا وقت (اوسط) 82.24s 142.59s
ردِعمل کا وقت (زیادہ سے زیادہ) 226.38s 1539.97s
ردِعمل کا وقت (کل) 1315.88s 1996.21s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#220 Qwen3.5-9B

medium
لاگت
$0.001
وقت
35.9s
ٹوکنز
3,030 tok

#210 GLM 4.7 Flash

medium
غلط SVG
لاگت
$0.000
وقت
186.2s
ٹوکنز
12,112 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129
GLM 4.7 Flash 3.2 7.4 11.1% 1 55.33s 3,106 4,981 22,387

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں