নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen: Qwen3.7 Plus vs xAI: Grok 4.5

Grok 4.5 (medium) average score-এ এগিয়ে: 8.3 vs 7.9. Qwen3.7 Plus (medium)-এর benchmark খরচ কম: $0.267 vs $1.928. Qwen3.7 Plus (medium) দ্রুত: 51.51s vs 61.71s, pass rates 75.8% vs 78.8%.

প্রস্তাবিত মডেলQwen3.7 Plus (medium)Its score stays close to the best score here (7.9 vs 8.3), while costing about 7.2x less than Grok 4.5 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Qwen3.7 Plus Qwen3.7 Plus medium প্রকাশ: 2026-06-03 Grok 4.5 Grok 4.5 medium প্রকাশ: 2026-07-08
স্কোর 7.9 8.3
র‍্যাঙ্ক #43 #28
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.9 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 75.8% 78.8%
অস্থির টেস্ট 3 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.072 12.049
মোট খরচ $0.267 $1.928
ইনপুট মূল্য $0.320 / 1M $2.000 / 1M
আউটপুট মূল্য $1.280 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 115,233 122,146
আউটপুট টোকেন 6,162 5,514
রিজনিং টোকেন 173,267 275,053
প্রতিক্রিয়া সময় (গড়) 51.51s 61.71s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 315.30s 436.38s
প্রতিক্রিয়া সময় (মোট) 1133.15s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#43 Qwen3.7 Plus

medium
খরচ
$0.018
সময়
193.2s
টোকেন
10,821 tok

#28 xAI: Grok 4.5

medium
খরচ
$0.044
সময়
59.4s
টোকেন
7,512 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

দ্রুত তুলনা

তুলনার জুটি বদলান