নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.7 Plus vs Grok 4.3 (medium)

average score প্রায় সমান: 7.2 vs 7.1. Qwen3.7 Plus-এর benchmark খরচ কম: $0.106 vs $0.779. Qwen3.7 Plus দ্রুত: 12.09s vs 47.45s, pass rates 50.0% vs 68.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#81
মোট আউটপুট টোকেন
58,097
প্রতিক্রিয়া সময় (গড়)
12.09s
মোট খরচ
$0.106
র‍্যাঙ্ক
#83
মোট আউটপুট টোকেন
241,421
প্রতিক্রিয়া সময় (গড়)
47.45s
মোট খরচ
$0.779
প্রস্তাবিত মডেল Qwen3.7 Plus

It has the best score here (7.2), while costing about 7.3x less than Grok 4.3 (medium).

বিস্তারিত তুলনা

মেট্রিক Qwen3.7 Plus Qwen3.7 Plus none প্রকাশ: 2026-06-03 Grok 4.3 Grok 4.3 medium প্রকাশ: 2026-05-01
স্কোর 7.2 7.1
র‍্যাঙ্ক #81 #83
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 10.0 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 50.0% 68.2%
অস্থির টেস্ট 0 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.014 5.990
মোট খরচ $0.106 $0.779
ইনপুট মূল্য $0.320 / 1M $1.250 / 1M
আউটপুট মূল্য $1.280 / 1M $2.500 / 1M
মোট ইনপুট টোকেন 98,824 140,031
আউটপুট টোকেন 58,097 13,739
রিজনিং টোকেন 0 227,682
প্রতিক্রিয়া সময় (গড়) 12.09s 47.45s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 206.03s 216.69s
প্রতিক্রিয়া সময় (মোট) 265.89s 1043.83s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#81 Qwen3.7 Plus

none
খরচ
$0.019
সময়
213.5s
টোকেন
11,960 tok

#83 xAI: Grok 4.3

medium
খরচ
$0.009
সময়
19.0s
টোকেন
3,661 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

দ্রুত তুলনা

তুলনার জুটি বদলান