নেভিগেশন
AI BENCHY
Advertise here

Qwen3.5-122B-A10B (medium) vs Grok 4.20 (medium)

average score প্রায় সমান: 7.1 vs 7.1. Grok 4.20 (medium)-এর benchmark খরচ কম: $0.777 vs $1.046. Grok 4.20 (medium) দ্রুত: 29.47s vs 64.16s, pass rates 71.2% vs 63.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#80
মোট আউটপুট টোকেন
487,218
প্রতিক্রিয়া সময় (গড়)
64.16s
মোট খরচ
$1.046
র‍্যাঙ্ক
#83
মোট আউটপুট টোকেন
259,340
প্রতিক্রিয়া সময় (গড়)
29.47s
মোট খরচ
$0.777
প্রস্তাবিত মডেল Grok 4.20 (medium)

It has the best score here (7.1), while responding about 2.2x faster than Qwen3.5-122B-A10B (medium).

বিস্তারিত তুলনা

মেট্রিক Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium প্রকাশ: 2026-02-24 Grok 4.20 Grok 4.20 medium প্রকাশ: 2026-03-31
স্কোর 7.1 7.1
র‍্যাঙ্ক #80 #83
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.5 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 71.2% 63.6%
অস্থির টেস্ট 4 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.509 9.709
মোট খরচ $1.046 $0.777
ইনপুট মূল্য $0.260 / 1M $1.250 / 1M
আউটপুট মূল্য $2.080 / 1M $2.500 / 1M
মোট ইনপুট টোকেন 124,771 102,791
আউটপুট টোকেন 44,077 5,363
রিজনিং টোকেন 443,141 253,977
প্রতিক্রিয়া সময় (গড়) 64.16s 29.47s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 519.30s 199.66s
প্রতিক্রিয়া সময় (মোট) 1411.60s 648.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#80 Qwen3.5-122B-A10B

medium
খরচ
$0.019
সময়
48.7s
টোকেন
6,034 tok

#83 xAI: Grok 4.20

medium
খরচ
$0.041
সময়
110.3s
টোকেন
16,336 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

দ্রুত তুলনা

তুলনার জুটি বদলান