নেভিগেশন
AI BENCHY
Advertise here

Qwen3.6 Plus (medium) vs GLM 5.2 (medium)

average score প্রায় সমান: 7.8 vs 7.8. GLM 5.2 (medium)-এর benchmark খরচ কম: $0.176 vs $0.405. GLM 5.2 (medium) দ্রুত: 23.28s vs 43.12s, pass rates 71.2% vs 80.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-01

র‍্যাঙ্ক
#48
মোট আউটপুট টোকেন
191,237
প্রতিক্রিয়া সময় (গড়)
43.12s
মোট খরচ
$0.405
র‍্যাঙ্ক
#49
মোট আউটপুট টোকেন
61,761
প্রতিক্রিয়া সময় (গড়)
23.28s
মোট খরচ
$0.176
প্রস্তাবিত মডেল GLM 5.2 (medium)

It has the best score here (7.8), while costing about 2.3x less than Qwen3.6 Plus (medium).

বিস্তারিত তুলনা

মেট্রিক Qwen3.6 Plus Qwen3.6 Plus medium প্রকাশ: 2026-04-20 GLM 5.2 GLM 5.2 medium প্রকাশ: 2026-06-17
স্কোর 7.8 7.8
র‍্যাঙ্ক #48 #49
নির্ভরযোগ্যতা 10.0 9.5
ধারাবাহিকতা 9.3 8.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 71.2% 80.3%
অস্থির টেস্ট 2 4
মোট রান 66 63
প্রতি ফলাফলে খরচ 1.514 2.159
মোট খরচ $0.405 $0.176
ইনপুট মূল্য $0.325 / 1M $0.761 / 1M
আউটপুট মূল্য $1.950 / 1M $2.389 / 1M
মোট ইনপুট টোকেন 97,689 37,199
আউটপুট টোকেন 6,412 12,261
রিজনিং টোকেন 184,825 49,500
প্রতিক্রিয়া সময় (গড়) 43.12s 23.28s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 291.55s 101.36s
প্রতিক্রিয়া সময় (মোট) 905.53s 488.94s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#48 Qwen3.6 Plus

medium
খরচ
$0.024
সময়
219.0s
টোকেন
12,235 tok

#49 GLM 5.2

medium
খরচ
$0.041
সময়
195.8s
টোকেন
9,287 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 Plus 6.1 7.8 44.4% 1 153.12s 7,098 58 50,586
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

দ্রুত তুলনা

তুলনার জুটি বদলান