নেভিগেশন
AI BENCHY
Advertise here

Qwen3.8 Max (low) vs Grok 4.6 (medium)

Qwen3.8 Max (low) average score-এ এগিয়ে: 8.6 vs 8.4. Qwen3.8 Max (low)-এর benchmark খরচ কম: $0.702 vs $1.713. Qwen3.8 Max (low) দ্রুত: 21.83s vs 73.46s, pass rates 80.3% vs 81.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-15

র‍্যাঙ্ক
#35
মোট আউটপুট টোকেন
83,821
প্রতিক্রিয়া সময় (গড়)
21.83s
মোট খরচ
$0.702
র‍্যাঙ্ক
#39
মোট আউটপুট টোকেন
249,808
প্রতিক্রিয়া সময় (গড়)
73.46s
মোট খরচ
$1.713
প্রস্তাবিত মডেল Qwen3.8 Max (low)

It has the best score here (8.6), while costing about 2.4x less than Grok 4.6 (medium).

বিস্তারিত তুলনা

মেট্রিক Qwen3.8 Max Qwen3.8 Max low প্রকাশ: 2026-08-04 Grok 4.6 Grok 4.6 medium প্রকাশ: 2026-08-12
স্কোর 8.6 8.4
র‍্যাঙ্ক #35 #39
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.0 8.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 80.3% 81.8%
অস্থির টেস্ট 3 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.384 10.703
মোট খরচ $0.702 $1.713
ইনপুট মূল্য $2.000 / 1M $2.000 / 1M
আউটপুট মূল্য $6.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 99,181 106,787
আউটপুট টোকেন 6,132 4,811
রিজনিং টোকেন 77,689 244,997
প্রতিক্রিয়া সময় (গড়) 21.83s 73.46s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 155.75s 514.35s
প্রতিক্রিয়া সময় (মোট) 480.37s 1616.12s
প্যারামিটার 2.4T মোট (~100B সক্রিয়) ~1.7T মোট (~170B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#35 Qwen3.8 Max

low
খরচ
$0.026
সময়
68.5s
টোকেন
4,280 tok

#39 SpaceXAI: Grok 4.6

medium
খরচ
$0.028
সময়
72.1s
টোকেন
4,771 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.8 Max 8.4 7.4 88.9% 1 28.69s 8,127 512 15,952
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

দ্রুত তুলনা

তুলনার জুটি বদলান