নেভিগেশন
Advertise here

Qwen3.7 Max (medium) vs Grok 4.6 (high)

average score প্রায় সমান: 8.5 vs 8.5. Qwen3.7 Max (medium)-এর benchmark খরচ কম: $2.046 vs $2.629. Qwen3.7 Max (medium) দ্রুত: 48.35s vs 87.48s, pass rates 85.5% vs 82.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#67
মোট আউটপুট টোকেন
259,032
প্রতিক্রিয়া সময় (গড়)
48.35s
মোট খরচ
$2.046
র‍্যাঙ্ক
#64
মোট আউটপুট টোকেন
312,614
প্রতিক্রিয়া সময় (গড়)
87.48s
মোট খরচ
$2.629
প্রস্তাবিত মডেল Qwen3.7 Max (medium)

It has the best score here (8.5), while responding about 1.8x faster than Grok 4.6 (high).

বিস্তারিত তুলনা

মেট্রিক Qwen3.7 Max Qwen3.7 Max medium প্রকাশ: 2026-05-22 Grok 4.6 Grok 4.6 high প্রকাশ: 2026-08-12
স্কোর 8.5 8.5
র‍্যাঙ্ক #67 #64
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.7 10.0
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 85.5% 82.6%
অস্থির টেস্ট 4 0
মোট রান 69 69
প্রতি ফলাফলে খরচ 12.033 13.833
মোট খরচ $2.046 $2.629
ইনপুট মূল্য $1.475 / 1M $2.000 / 1M
আউটপুট মূল্য $4.425 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 367,848 376,233
আউটপুট টোকেন 8,753 6,687
রিজনিং টোকেন 250,279 305,927
প্রতিক্রিয়া সময় (গড়) 48.35s 87.48s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 556.06s 618.49s
প্রতিক্রিয়া সময় (মোট) 1112.11s 2012.15s
প্যারামিটার ~1T মোট (~40B সক্রিয়) ~1.7T মোট (~170B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Qwen3.7 Max

medium
খরচ
$0.017
সময়
68.8s
টোকেন
4,526 tok

#64 SpaceXAI: Grok 4.6

high
খরচ
$0.107
সময়
265.1s
টোকেন
18,001 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808
Grok 4.6 10.0 10.0 100.0% 0 102.20s 9,579 379 51,829

দ্রুত তুলনা

তুলনার জুটি বদলান