নেভিগেশন
AI BENCHY
Advertise here

Qwen3.8 27B (medium) vs GLM 5.2 (high)

GLM 5.2 (high) average score-এ এগিয়ে: 8.0 vs 7.8. স্থানীয় হার্ডওয়্যারের খরচ মাপা হয়নি, তাই খরচের তুলনা পাওয়া যায় না। Qwen3.8 27B (medium) দ্রুত: 33.05s vs 69.86s, pass rates 66.7% vs 69.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-15

র‍্যাঙ্ক
#68
মোট আউটপুট টোকেন
136,162
প্রতিক্রিয়া সময় (গড়)
33.05s
মোট খরচ
প্রযোজ্য নয়
র‍্যাঙ্ক
#55
মোট আউটপুট টোকেন
364,655
প্রতিক্রিয়া সময় (গড়)
69.86s
মোট খরচ
$1.463
প্রস্তাবিত মডেল GLM 5.2 (high)

It has the strongest score in this comparison (8.0) and the best overall balance of cost and response time across all 2 models.

বিস্তারিত তুলনা

মেট্রিক Qwen3.8 27B Qwen3.8 27B medium প্রকাশ: 2026-08-14 GLM 5.2 GLM 5.2 high প্রকাশ: 2026-06-17
স্কোর 7.8 8.0
র‍্যাঙ্ক #68 #55
নির্ভরযোগ্যতা 9.6 10.0
ধারাবাহিকতা 9.7 8.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 66.7% 69.7%
অস্থির টেস্ট 1 3
মোট রান 66 66
প্রতি ফলাফলে খরচ প্রযোজ্য নয় 6.849
মোট খরচ প্রযোজ্য নয় $1.463
ইনপুট মূল্য প্রযোজ্য নয় $1.190 / 1M
আউটপুট মূল্য প্রযোজ্য নয় $3.740 / 1M
মোট ইনপুট টোকেন 98,266 83,822
আউটপুট টোকেন 1,861 72,040
রিজনিং টোকেন 134,301 292,615
প্রতিক্রিয়া সময় (গড়) 33.05s 69.86s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 214.63s 599.43s
প্রতিক্রিয়া সময় (মোট) 694.04s 1536.98s
প্যারামিটার 27.3B 744B মোট (40B সক্রিয়)
উপলভ্যতা ওজন উপলভ্য উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#68 Qwen3.8 27B

medium
খরচ
প্রযোজ্য নয়
সময়
43.4s
টোকেন
2,956 tok

#55 GLM 5.2

high
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

দ্রুত তুলনা

তুলনার জুটি বদলান

Claude Opus 4.8lowvsQwen3.8 27BmediumDeepSeek V4 Flash 0731lowvsGLM 5.2highInklingmediumvsGLM 5.2highSeed-2.0-CodelowvsQwen3.8 27BmediumKimi K3maxvsGLM 5.2highGPT-5.2 ChatnonevsGLM 5.2highStep 3.7 FlashmediumvsGLM 5.2highMuse Glimmer 30BxhighvsGLM 5.2highGPT-5 MinimediumvsGLM 5.2highQwen3.8 27BlowvsGLM 5.2highQwen3.8 2.4T A95BlowvsGLM 5.2highDeepSeek V4 ProhighvsQwen3.8 27Bmedium