নেভিগেশন
AI BENCHY
Advertise here

Qwen: Qwen3.7 Max vs Z.ai: GLM 5 Turbo

GLM 5 Turbo (medium) average score-এ এগিয়ে: 7.6 vs 7.4. Qwen3.7 Max-এর benchmark খরচ কম: $0.197 vs $0.323. Qwen3.7 Max দ্রুত: 4.52s vs 23.00s, pass rates 68.2% vs 71.2%.

প্রস্তাবিত মডেলQwen3.7 MaxIts score stays close to the best score here (7.4 vs 7.6), while costing about 1.6x less than GLM 5 Turbo (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Qwen3.7 Max Qwen3.7 Max none প্রকাশ: 2026-05-22 GLM 5 Turbo GLM 5 Turbo medium প্রকাশ: 2026-03-15
স্কোর 7.4 7.6
র‍্যাঙ্ক #67 #56
নির্ভরযোগ্যতা 9.9 10.0
ধারাবাহিকতা 10.0 8.1
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 68.2% 71.2%
অস্থির টেস্ট 0 4
মোট রান 66 63
প্রতি ফলাফলে খরচ 1.582 2.011
মোট খরচ $0.197 $0.323
ইনপুট মূল্য $1.475 / 1M $1.200 / 1M
আউটপুট মূল্য $4.425 / 1M $4.000 / 1M
মোট ইনপুট টোকেন 95,983 35,593
আউটপুট টোকেন 12,446 12,245
রিজনিং টোকেন 0 62,277
প্রতিক্রিয়া সময় (গড়) 4.52s 23.00s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 72.30s 194.23s
প্রতিক্রিয়া সময় (মোট) 99.52s 482.97s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Qwen3.7 Max

none
খরচ
$0.046
সময়
195.0s
টোকেন
12,171 tok

#56 GLM 5 Turbo

medium
খরচ
$0.074
সময়
206.0s
টোকেন
18,549 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
GLM 5 Turbo 8.2 9.3 66.7% 0 45.90s 5,941 363 25,381

দ্রুত তুলনা

তুলনার জুটি বদলান