নেভিগেশন
AI BENCHY
Advertise here

Qwen3.7 Max (medium) vs Qwen3.8 Max (medium)

average score প্রায় সমান: 9.2 vs 9.1. Qwen3.8 Max (medium)-এর benchmark খরচ কম: $0.728 vs $1.116. Qwen3.8 Max (medium) দ্রুত: 21.53s vs 40.57s, pass rates 87.9% vs 84.9%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-04

র‍্যাঙ্ক
#12
মোট আউটপুট টোকেন
216,752
প্রতিক্রিয়া সময় (গড়)
40.57s
মোট খরচ
$1.116
র‍্যাঙ্ক
#14
মোট আউটপুট টোকেন
84,826
প্রতিক্রিয়া সময় (গড়)
21.53s
মোট খরচ
$0.728
প্রস্তাবিত মডেল Qwen3.8 Max (medium)

It has the best score here (9.1), while costing about 1.5x less than Qwen3.7 Max (medium).

বিস্তারিত তুলনা

মেট্রিক Qwen3.7 Max Qwen3.7 Max medium প্রকাশ: 2026-05-22 Qwen3.8 Max Qwen3.8 Max medium প্রকাশ: 2026-08-04
স্কোর 9.2 9.1
র‍্যাঙ্ক #12 #14
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.3 9.7
বেঞ্চমার্ক কভারেজ 22/22 টেস্ট · 66/66 প্রচেষ্টা 22/22 টেস্ট · 66/66 প্রচেষ্টা
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 87.9% 84.9%
অস্থির টেস্ট 2 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.292 4.040
মোট খরচ $1.116 $0.728
ইনপুট মূল্য $1.475 / 1M $2.000 / 1M
আউটপুট মূল্য $4.425 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 106,020 109,046
আউটপুট টোকেন 5,748 6,567
রিজনিং টোকেন 211,004 78,259
প্রতিক্রিয়া সময় (গড়) 40.57s 21.53s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 556.06s 126.60s
প্রতিক্রিয়া সময় (মোট) 892.57s 473.75s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Qwen3.7 Max

medium
খরচ
$0.017
সময়
68.8s
টোকেন
4,526 tok

#14 Qwen3.8 Max

medium
খরচ
$0.028
সময়
71.9s
টোকেন
4,750 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808
Qwen3.8 Max 10.0 10.0 100.0% 0 41.35s 7,893 430 23,804

দ্রুত তুলনা

তুলনার জুটি বদলান