নেভিগেশন
AI BENCHY
Advertise here

Anthropic: Claude Sonnet 5 vs Qwen: Qwen3.6 Max Preview

Qwen3.6 Max Preview (medium) average score-এ এগিয়ে: 8.4 vs 8.3. Claude Sonnet 5 (medium)-এর benchmark খরচ কম: $0.922 vs $1.143. Claude Sonnet 5 (medium) দ্রুত: 12.52s vs 67.53s, pass rates 80.3% vs 80.3%.

প্রস্তাবিত মডেলClaude Sonnet 5 (medium)Its score stays close to the best score here (8.3 vs 8.4), while responding about 5.4x faster than Qwen3.6 Max Preview (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Sonnet 5 Claude Sonnet 5 medium প্রকাশ: 2026-06-30 Qwen3.6 Max Preview Qwen3.6 Max Preview medium প্রকাশ: 2026-04-20
স্কোর 8.3 8.4
র‍্যাঙ্ক #29 #25
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 9.0 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 80.3% 80.3%
অস্থির টেস্ট 3 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 5.760 8.173
মোট খরচ $0.922 $1.143
ইনপুট মূল্য $2.000 / 1M $1.040 / 1M
আউটপুট মূল্য $10.000 / 1M $6.240 / 1M
মোট ইনপুট টোকেন 145,956 79,240
আউটপুট টোকেন 52,333 5,098
রিজনিং টোকেন 10,874 164,842
প্রতিক্রিয়া সময় (গড়) 12.52s 67.53s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 66.71s 238.07s
প্রতিক্রিয়া সময় (মোট) 275.42s 1485.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 Claude Sonnet 5

medium
খরচ
$0.007
সময়
6.4s
টোকেন
832 tok

#25 Qwen3.6 Max Preview

medium
খরচ
$0.024
সময়
76.5s
টোকেন
3,861 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 5 9.0 7.9 88.9% 1 17.28s 10,590 13,153 2,379
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957

দ্রুত তুলনা

তুলনার জুটি বদলান