নেভিগেশন
AI BENCHY
Advertise here

Qwen: Qwen3.6 Max Preview vs Z.ai: GLM 5.2

average score প্রায় সমান: 6.6 vs 6.6. GLM 5.2-এর benchmark খরচ কম: $0.125 vs $0.231. Qwen3.6 Max Preview দ্রুত: 7.82s vs 9.34s, pass rates 60.6% vs 59.1%.

প্রস্তাবিত মডেলGLM 5.2It has the best score here (6.6), while costing about 1.8x less than Qwen3.6 Max Preview.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Qwen3.6 Max Preview Qwen3.6 Max Preview none প্রকাশ: 2026-04-20 GLM 5.2 GLM 5.2 none প্রকাশ: 2026-06-17
স্কোর 6.6 6.6
র‍্যাঙ্ক #107 #105
নির্ভরযোগ্যতা 9.9 10.0
ধারাবাহিকতা 9.3 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 60.6% 59.1%
অস্থির টেস্ট 2 2
মোট রান 66 64
প্রতি ফলাফলে খরচ 2.061 1.421
মোট খরচ $0.231 $0.125
ইনপুট মূল্য $1.040 / 1M $0.793 / 1M
আউটপুট মূল্য $6.240 / 1M $2.491 / 1M
মোট ইনপুট টোকেন 106,339 112,359
আউটপুট টোকেন 19,257 14,340
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 7.82s 9.34s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 102.62s 79.65s
প্রতিক্রিয়া সময় (মোট) 172.01s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#107 Qwen3.6 Max Preview

none
খরচ
$0.025
সময়
83.9s
টোকেন
4,066 tok

#105 GLM 5.2

none
অবৈধ SVG
খরচ
$0.033
সময়
87.7s
টোকেন
7,455 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 Max Preview 3.8 7.3 22.2% 1 3.12s 7,913 456 0
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

দ্রুত তুলনা

তুলনার জুটি বদলান