নেভিগেশন
AI BENCHY
Advertise here

Qwen: Qwen3.7 Max vs xAI: Grok 4.5

Qwen3.7 Max (medium) average score-এ এগিয়ে: 9.2 vs 8.4. Grok 4.5 (low)-এর benchmark খরচ কম: $0.935 vs $1.116. Grok 4.5 (low) দ্রুত: 15.56s vs 40.57s, pass rates 87.9% vs 75.8%.

প্রস্তাবিত মডেলQwen3.7 Max (medium)It has the strongest score in this comparison (9.2) and the best overall balance of cost and response time across all 2 models.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-21

মেট্রিক Qwen3.7 Max Qwen3.7 Max medium প্রকাশ: 2026-05-22 Grok 4.5 Grok 4.5 low প্রকাশ: 2026-07-08
স্কোর 9.2 8.4
র‍্যাঙ্ক #11 #23
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.3 9.7
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 87.9% 75.8%
অস্থির টেস্ট 2 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.292 5.844
মোট খরচ $1.116 $0.935
ইনপুট মূল্য $1.475 / 1M $2.000 / 1M
আউটপুট মূল্য $4.425 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 106,020 125,596
আউটপুট টোকেন 5,748 7,505
রিজনিং টোকেন 211,004 106,446
প্রতিক্রিয়া সময় (গড়) 40.57s 15.56s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 556.06s 205.28s
প্রতিক্রিয়া সময় (মোট) 892.57s 342.32s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Qwen3.7 Max

medium
খরচ
$0.017
সময়
68.8s
টোকেন
4,526 tok

#23 xAI: Grok 4.5

low
খরচ
$0.011
সময়
12.4s
টোকেন
2,018 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

দ্রুত তুলনা

তুলনার জুটি বদলান