নেভিগেশন
AI BENCHY
Advertise here

Qwen3.7 Plus vs GLM 5.1 (medium)

average score প্রায় সমান: 7.2 vs 7.1. Qwen3.7 Plus-এর benchmark খরচ কম: $0.106 vs $0.535. Qwen3.7 Plus দ্রুত: 12.09s vs 46.77s, pass rates 50.0% vs 69.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#79
মোট আউটপুট টোকেন
58,097
প্রতিক্রিয়া সময় (গড়)
12.09s
মোট খরচ
$0.106
র‍্যাঙ্ক
#82
মোট আউটপুট টোকেন
152,552
প্রতিক্রিয়া সময় (গড়)
46.77s
মোট খরচ
$0.535
প্রস্তাবিত মডেল Qwen3.7 Plus

It has the best score here (7.2), while costing about 5.0x less than GLM 5.1 (medium).

বিস্তারিত তুলনা

মেট্রিক Qwen3.7 Plus Qwen3.7 Plus none প্রকাশ: 2026-06-03 GLM 5.1 GLM 5.1 medium প্রকাশ: 2026-04-07
স্কোর 7.2 7.1
র‍্যাঙ্ক #79 #82
নির্ভরযোগ্যতা 10.0 8.3
ধারাবাহিকতা 10.0 8.4
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 50.0% 69.7%
অস্থির টেস্ট 0 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.014 4.202
মোট খরচ $0.106 $0.535
ইনপুট মূল্য $0.320 / 1M $0.966 / 1M
আউটপুট মূল্য $1.280 / 1M $3.036 / 1M
মোট ইনপুট টোকেন 98,824 82,623
আউটপুট টোকেন 58,097 16,089
রিজনিং টোকেন 0 136,463
প্রতিক্রিয়া সময় (গড়) 12.09s 46.77s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 206.03s 308.75s
প্রতিক্রিয়া সময় (মোট) 265.89s 982.16s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#79 Qwen3.7 Plus

none
খরচ
$0.019
সময়
213.5s
টোকেন
11,960 tok

#82 GLM 5.1

medium
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

দ্রুত তুলনা

তুলনার জুটি বদলান