নেভিগেশন
AI BENCHY
Advertise here

Anthropic: Claude Sonnet 4.6 vs Qwen: Qwen3.7 Max

Qwen3.7 Max average score-এ এগিয়ে: 7.4 vs 7.3. Qwen3.7 Max-এর benchmark খরচ কম: $0.197 vs $0.661. Qwen3.7 Max দ্রুত: 4.52s vs 8.12s, pass rates 57.6% vs 68.2%.

প্রস্তাবিত মডেলQwen3.7 MaxIt has the best score here (7.4), while costing about 3.4x less than Claude Sonnet 4.6.
র‍্যাঙ্ক
#71
প্রতি চেষ্টায় পাস রেট
57.6%
মোট আউটপুট টোকেন
19,362
প্রতিক্রিয়া সময় (গড়)
8.12s
মোট খরচ
$0.661
র‍্যাঙ্ক
#67
প্রতি চেষ্টায় পাস রেট
68.2%
মোট আউটপুট টোকেন
12,446
প্রতিক্রিয়া সময় (গড়)
4.52s
মোট খরচ
$0.197

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Sonnet 4.6 Claude Sonnet 4.6 none প্রকাশ: 2026-02-17 Qwen3.7 Max Qwen3.7 Max none প্রকাশ: 2026-05-22
স্কোর 7.3 7.4
র‍্যাঙ্ক #71 #67
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 9.7 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 57.6% 68.2%
অস্থির টেস্ট 1 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 5.502 1.582
মোট খরচ $0.661 $0.197
ইনপুট মূল্য $3.000 / 1M $1.475 / 1M
আউটপুট মূল্য $15.000 / 1M $4.425 / 1M
মোট ইনপুট টোকেন 123,264 95,983
আউটপুট টোকেন 19,362 12,446
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 8.12s 4.52s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 51.18s 72.30s
প্রতিক্রিয়া সময় (মোট) 121.78s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Claude Sonnet 4.6

none
খরচ
$0.038
সময়
27.3s
টোকেন
2,598 tok

#67 Qwen3.7 Max

none
খরচ
$0.046
সময়
195.0s
টোকেন
12,171 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

দ্রুত তুলনা

তুলনার জুটি বদলান