নেভিগেশন
AI BENCHY
Advertise here

Qwen3.8 Max (low) vs Grok 4.5 (medium)

Qwen3.8 Max (low) average score-এ এগিয়ে: 8.6 vs 8.5. Qwen3.8 Max (low)-এর benchmark খরচ কম: $0.702 vs $2.042. Qwen3.8 Max (low) দ্রুত: 21.83s vs 68.59s, pass rates 80.3% vs 83.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-15

র‍্যাঙ্ক
#35
মোট আউটপুট টোকেন
83,821
প্রতিক্রিয়া সময় (গড়)
21.83s
মোট খরচ
$0.702
র‍্যাঙ্ক
#37
মোট আউটপুট টোকেন
299,460
প্রতিক্রিয়া সময় (গড়)
68.59s
মোট খরচ
$2.042
প্রস্তাবিত মডেল Qwen3.8 Max (low)

It has the best score here (8.6), while costing about 2.9x less than Grok 4.5 (medium).

বিস্তারিত তুলনা

মেট্রিক Qwen3.8 Max Qwen3.8 Max low প্রকাশ: 2026-08-04 Grok 4.5 Grok 4.5 medium প্রকাশ: 2026-07-08
স্কোর 8.6 8.5
র‍্যাঙ্ক #35 #37
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.0 8.9
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 80.3% 83.3%
অস্থির টেস্ট 3 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.384 12.007
মোট খরচ $0.702 $2.042
ইনপুট মূল্য $2.000 / 1M $2.000 / 1M
আউটপুট মূল্য $6.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 99,181 122,155
আউটপুট টোকেন 6,132 5,514
রিজনিং টোকেন 77,689 293,946
প্রতিক্রিয়া সময় (গড়) 21.83s 68.59s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 155.75s 436.38s
প্রতিক্রিয়া সময় (মোট) 480.37s 1508.91s
প্যারামিটার 2.4T মোট (~100B সক্রিয়) ~1.7T মোট (~170B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#35 Qwen3.8 Max

low
খরচ
$0.026
সময়
68.5s
টোকেন
4,280 tok

#37 SpaceXAI: Grok 4.5

medium
খরচ
$0.044
সময়
59.4s
টোকেন
7,512 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.8 Max 8.4 7.4 88.9% 1 28.69s 8,127 512 15,952
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

দ্রুত তুলনা

তুলনার জুটি বদলান