নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-9B vs xAI: Grok 4.20

সারাংশ

Qwen3.5-9B vs Grok 4.20 benchmark তুলনা: Grok 4.20 average score-এ এগিয়ে: 5.4 vs 4.2. Qwen3.5-9B-এর benchmark খরচ কম: $0.036 vs $0.057. Grok 4.20 দ্রুত: 1.11s vs 82.24s, pass rates 27.0% vs 33.3%.

প্রস্তাবিত মডেল: Grok 4.20 - It has the best score here (5.4), while responding about 74.2x faster than Qwen3.5-9B.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-10

মেট্রিক Qwen3.5-9B Qwen3.5-9B medium প্রকাশ: 2026-03-02 Grok 4.20 Grok 4.20 none প্রকাশ: 2026-03-31
স্কোর 4.2 5.4
র‍্যাঙ্ক #162 #128
নির্ভরযোগ্যতা 6.7 প্রযোজ্য নয়
ধারাবাহিকতা 8.0 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 27.0% 33.3%
অস্থির টেস্ট 5 0
মোট রান 63 54
প্রতি ফলাফলে খরচ 1.187 1.570
মোট খরচ $0.036 $0.057
ইনপুট মূল্য $0.100 / 1M $1.250 / 1M
আউটপুট মূল্য $0.150 / 1M $2.500 / 1M
মোট ইনপুট টোকেন 17,070 41,313
আউটপুট টোকেন 29,045 1,923
রিজনিং টোকেন 209,516 0
প্রতিক্রিয়া সময় (গড়) 82.24s 1.11s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 226.38s 6.04s
প্রতিক্রিয়া সময় (মোট) 1315.88s 19.96s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#162 Qwen3.5-9B

medium
Cost
$0.001
Time
35.9s
Tokens
3,030 tok

#128 xAI: Grok 4.20

none
Cost
$0.004
Time
6.5s
Tokens
1,367 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-9B 5.1 5.8 50.0% 2 34.44s 369 2,621 12,411
Grok 4.20 4.8 10.0 25.0% 0 501ms 1,986 267 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129
Grok 4.20 3.4 9.3 0.0% 0 1.22s 1,074 312 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-9B 3.0 10.0 0.0% 0 0ms 0 0 0
Grok 4.20 3.0 10.0 0.0% 0 6.04s 17,673 282 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-9B 3.6 5.6 33.3% 1 87.31s 4,722 1,383 32,113
Grok 4.20 10.0 10.0 100.0% 0 522ms 7,749 207 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-9B 3.6 7.2 22.2% 1 137.75s 295 11,549 48,475
Grok 4.20 3.0 10.0 0.0% 0 687ms 1,746 325 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-9B 2.8 1.6 33.3% 1 226.38s 180 0 30,695
Grok 4.20 4.8 10.0 0.0% 0 659ms 819 83 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-9B 6.5 10.0 50.0% 0 5.75s 381 491 1,824
Grok 4.20 6.3 10.0 50.0% 0 445ms 1,350 60 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-9B 3.0 10.0 0.0% 0 32.27s 376 1,593 12,026
Grok 4.20 5.3 10.0 33.3% 0 473ms 1,671 198 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-9B 10.0 10.0 100.0% 0 4.31s 8,283 444 1,149
Grok 4.20 10.0 10.0 100.0% 0 4.63s 7,245 189 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-9B 3.0 10.0 0.0% 0 177.02s 68 3,074 29,694
Grok 4.20 - - - - - - - - -

দ্রুত তুলনা

তুলনার জুটি বদলান