নেভিগেশন
AI BENCHY
Advertise here

Qwen3.7 Plus vs Grok 4.6 (low)

Grok 4.6 (low) average score-এ এগিয়ে: 7.4 vs 7.3. Qwen3.7 Plus-এর benchmark খরচ কম: $0.106 vs $0.449. Qwen3.7 Plus দ্রুত: 12.11s vs 14.55s, pass rates 54.6% vs 69.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-14

র‍্যাঙ্ক
#98
মোট আউটপুট টোকেন
58,097
প্রতিক্রিয়া সময় (গড়)
12.11s
মোট খরচ
$0.106
র‍্যাঙ্ক
#93
মোট আউটপুট টোকেন
38,048
প্রতিক্রিয়া সময় (গড়)
14.55s
মোট খরচ
$0.449
প্রস্তাবিত মডেল Qwen3.7 Plus

Its score stays close to the best score here (7.3 vs 7.4), while costing about 4.2x less than Grok 4.6 (low).

বিস্তারিত তুলনা

মেট্রিক Qwen3.7 Plus Qwen3.7 Plus none প্রকাশ: 2026-06-03 Grok 4.6 Grok 4.6 low প্রকাশ: 2026-08-12
স্কোর 7.3 7.4
র‍্যাঙ্ক #98 #93
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 10.0 9.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 54.6% 69.7%
অস্থির টেস্ট 0 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.930 2.989
মোট খরচ $0.106 $0.449
ইনপুট মূল্য $0.320 / 1M $2.000 / 1M
আউটপুট মূল্য $1.280 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 98,833 109,960
আউটপুট টোকেন 58,097 5,124
রিজনিং টোকেন 0 32,924
প্রতিক্রিয়া সময় (গড়) 12.11s 14.55s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 206.03s 26.46s
প্রতিক্রিয়া সময় (মোট) 266.40s 320.17s
প্যারামিটার ~397B মোট (~17B সক্রিয়) ~1.7T মোট (~170B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 Qwen3.7 Plus

none
খরচ
$0.019
সময়
213.5s
টোকেন
11,960 tok

#93 SpaceXAI: Grok 4.6

low
খরচ
$0.011
সময়
26.0s
টোকেন
1,941 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

দ্রুত তুলনা

তুলনার জুটি বদলান