नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen: Qwen3.5-9B vs Z.ai: GLM 4.7 Flash

GLM 4.7 Flash (medium) average score मध्ये पुढे आहे: 4.3 vs 3.8. Qwen3.5-9B (medium) चा benchmark खर्च कमी आहे: $0.036 vs $0.166. Qwen3.5-9B (medium) वेगवान आहे: 82.24s vs 142.59s, pass rates 25.8% vs 31.8%.

शिफारस केलेले मॉडेलGLM 4.7 Flash (medium)It has the strongest score in this comparison (4.3) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Qwen3.5-9B Qwen3.5-9B medium प्रकाशन: 2026-03-02 GLM 4.7 Flash GLM 4.7 Flash medium प्रकाशन: 2026-01-19
स्कोअर 3.8 4.3
क्रमांक #220 #210
विश्वसनीयता 5.0 7.8
सुसंगतता 8.1 7.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 25.8% 31.8%
अस्थिर चाचण्या 5 8
एकूण रन 66 66
प्रति निकाल खर्च 1.187 4.147
एकूण खर्च $0.036 $0.166
इनपुट किंमत $0.100 / 1M $0.060 / 1M
आउटपुट किंमत $0.150 / 1M $0.400 / 1M
एकूण इनपुट टोकन्स 17,070 79,051
आउटपुट टोकन्स 29,045 43,754
रिझनिंग टोकन्स 209,516 374,109
प्रतिसाद वेळ (सरासरी) 82.24s 142.59s
प्रतिसाद वेळ (कमाल) 226.38s 1539.97s
प्रतिसाद वेळ (एकूण) 1315.88s 1996.21s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#220 Qwen3.5-9B

medium
खर्च
$0.001
वेळ
35.9s
टोकन्स
3,030 tok

#210 GLM 4.7 Flash

medium
अवैध SVG
खर्च
$0.000
वेळ
186.2s
टोकन्स
12,112 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129
GLM 4.7 Flash 3.2 7.4 11.1% 1 55.33s 3,106 4,981 22,387

झटपट तुलना

तुलना जोडी बदला