নেভিগেশন
AI BENCHY
Advertise here

Qwen: Qwen3.5-9B vs Z.ai: GLM 4.7 Flash

GLM 4.7 Flash (medium) average score-এ এগিয়ে: 4.3 vs 3.8. Qwen3.5-9B (medium)-এর benchmark খরচ কম: $0.036 vs $0.166. Qwen3.5-9B (medium) দ্রুত: 82.24s vs 142.59s, pass rates 25.8% vs 31.8%.

প্রস্তাবিত মডেলGLM 4.7 Flash (medium)It has the strongest score in this comparison (4.3) and the best overall balance of cost and response time across all 2 models.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Qwen3.5-9B Qwen3.5-9B medium প্রকাশ: 2026-03-02 GLM 4.7 Flash GLM 4.7 Flash medium প্রকাশ: 2026-01-19
স্কোর 3.8 4.3
র‍্যাঙ্ক #220 #210
নির্ভরযোগ্যতা 5.0 7.8
ধারাবাহিকতা 8.1 7.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 25.8% 31.8%
অস্থির টেস্ট 5 8
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.187 4.147
মোট খরচ $0.036 $0.166
ইনপুট মূল্য $0.100 / 1M $0.060 / 1M
আউটপুট মূল্য $0.150 / 1M $0.400 / 1M
মোট ইনপুট টোকেন 17,070 79,051
আউটপুট টোকেন 29,045 43,754
রিজনিং টোকেন 209,516 374,109
প্রতিক্রিয়া সময় (গড়) 82.24s 142.59s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 226.38s 1539.97s
প্রতিক্রিয়া সময় (মোট) 1315.88s 1996.21s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#220 Qwen3.5-9B

medium
খরচ
$0.001
সময়
35.9s
টোকেন
3,030 tok

#210 GLM 4.7 Flash

medium
অবৈধ SVG
খরচ
$0.000
সময়
186.2s
টোকেন
12,112 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129
GLM 4.7 Flash 3.2 7.4 11.1% 1 55.33s 3,106 4,981 22,387

দ্রুত তুলনা

তুলনার জুটি বদলান