নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen: Qwen3.6 Max Preview vs Z.ai: GLM 5.2

Qwen3.6 Max Preview (medium) average score-এ এগিয়ে: 8.4 vs 8.0. GLM 5.2 (high)-এর benchmark খরচ কম: $0.296 vs $1.143. GLM 5.2 (high) দ্রুত: 62.65s vs 67.53s, pass rates 80.3% vs 71.2%.

প্রস্তাবিত মডেলGLM 5.2 (high)Its score stays close to the best score here (8.0 vs 8.4), while costing about 3.9x less than Qwen3.6 Max Preview (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-18

মেট্রিক Qwen3.6 Max Preview Qwen3.6 Max Preview medium প্রকাশ: 2026-04-20 GLM 5.2 GLM 5.2 high প্রকাশ: 2026-06-17
স্কোর 8.4 8.0
র‍্যাঙ্ক #19 #31
নির্ভরযোগ্যতা 9.9 10.0
ধারাবাহিকতা 8.9 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 80.3% 71.2%
অস্থির টেস্ট 3 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.173 5.873
মোট খরচ $1.143 $0.296
ইনপুট মূল্য $1.040 / 1M $0.293 / 1M
আউটপুট মূল্য $6.240 / 1M $0.920 / 1M
মোট ইনপুট টোকেন 79,240 83,813
আউটপুট টোকেন 5,098 69,688
রিজনিং টোকেন 164,842 225,659
প্রতিক্রিয়া সময় (গড়) 67.53s 62.65s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 238.07s 599.43s
প্রতিক্রিয়া সময় (মোট) 1485.64s 1378.34s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 Qwen3.6 Max Preview

medium
খরচ
$0.024
সময়
76.5s
টোকেন
3,861 tok

#31 GLM 5.2

high
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

দ্রুত তুলনা

তুলনার জুটি বদলান