নেভিগেশন
AI BENCHY
Advertise here

Qwen: Qwen3.6 Max Preview vs xAI: Grok 4.5

Qwen3.6 Max Preview (medium) average score-এ এগিয়ে: 8.4 vs 8.3. Qwen3.6 Max Preview (medium)-এর benchmark খরচ কম: $1.143 vs $1.928. Grok 4.5 (medium) দ্রুত: 61.71s vs 67.53s, pass rates 80.3% vs 78.8%.

প্রস্তাবিত মডেলQwen3.6 Max Preview (medium)It has the best score here (8.4), while costing about 1.7x less than Grok 4.5 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Qwen3.6 Max Preview Qwen3.6 Max Preview medium প্রকাশ: 2026-04-20 Grok 4.5 Grok 4.5 medium প্রকাশ: 2026-07-08
স্কোর 8.4 8.3
র‍্যাঙ্ক #25 #28
নির্ভরযোগ্যতা 9.9 10.0
ধারাবাহিকতা 8.9 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 80.3% 78.8%
অস্থির টেস্ট 3 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.173 12.049
মোট খরচ $1.143 $1.928
ইনপুট মূল্য $1.040 / 1M $2.000 / 1M
আউটপুট মূল্য $6.240 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 79,240 122,146
আউটপুট টোকেন 5,098 5,514
রিজনিং টোকেন 164,842 275,053
প্রতিক্রিয়া সময় (গড়) 67.53s 61.71s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 238.07s 436.38s
প্রতিক্রিয়া সময় (মোট) 1485.64s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Qwen3.6 Max Preview

medium
খরচ
$0.024
সময়
76.5s
টোকেন
3,861 tok

#28 xAI: Grok 4.5

medium
খরচ
$0.044
সময়
59.4s
টোকেন
7,512 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

দ্রুত তুলনা

তুলনার জুটি বদলান