নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Anthropic: Claude Sonnet 5

সারাংশ

Claude Sonnet 4.6 vs Claude Sonnet 5 benchmark তুলনা: Claude Sonnet 4.6 average score-এ এগিয়ে: 7.3 vs 5.7. Claude Sonnet 5-এর benchmark খরচ কম: $0.287 vs $0.316. Claude Sonnet 5 দ্রুত: 4.74s vs 5.04s, pass rates 55.6% vs 42.9%.

প্রস্তাবিত মডেল: Claude Sonnet 4.6 - It has the strongest score in this comparison (7.3) and the best overall balance of cost and response time across all 2 models.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-30

মেট্রিক Claude Sonnet 4.6 Claude Sonnet 4.6 none প্রকাশ: 2026-02-17 Claude Sonnet 5 Claude Sonnet 5 none প্রকাশ: 2026-06-30
স্কোর 7.3 5.7
র‍্যাঙ্ক #57 #117
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.7 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 55.6% 42.9%
অস্থির টেস্ট 1 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 2.870 4.098
মোট খরচ $0.316 $0.287
ইনপুট মূল্য $3.000 / 1M $2.000 / 1M
আউটপুট মূল্য $15.000 / 1M $10.000 / 1M
মোট ইনপুট টোকেন 57,886 76,797
আউটপুট টোকেন 9,465 13,325
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 5.04s 4.74s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 23.84s 29.46s
প্রতিক্রিয়া সময় (মোট) 70.60s 99.46s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#57 Claude Sonnet 4.6

none
খরচ
$0.038
সময়
27.3s
টোকেন
2,598 tok

#117 Claude Sonnet 5

none
খরচ
$0.061
সময়
53.7s
টোকেন
6,172 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 4.8 10.0 25.0% 0 2.94s 636 1,214 0
Claude Sonnet 5 5.3 10.0 25.0% 0 3.60s 834 1,813 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
Claude Sonnet 5 4.6 7.9 22.2% 1 3.67s 10,590 1,864 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 9.5 10.0 100.0% 0 23.84s 26,024 3,766 0
Claude Sonnet 5 3.0 10.0 0.0% 0 29.46s 38,775 6,340 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.43s 8,574 252 0
Claude Sonnet 5 10.0 10.0 100.0% 0 3.01s 10,503 309 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 7.7 10.0 66.7% 0 3.54s 759 413 0
Claude Sonnet 5 5.3 7.2 44.4% 1 3.28s 975 933 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 6.1 3.1 66.7% 1 2.56s 513 192 0
Claude Sonnet 5 4.7 3.1 33.3% 1 2.81s 708 272 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 6.5 10.0 50.0% 0 1.96s 690 90 0
Claude Sonnet 5 6.4 10.0 50.0% 0 2.58s 909 103 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 7.7 10.0 66.7% 0 2.53s 663 533 0
Claude Sonnet 5 6.0 7.4 55.6% 1 3.22s 894 778 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 11,301 447 0
Claude Sonnet 5 10.0 10.0 100.0% 0 6.80s 12,351 522 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 3.0 10.0 0.0% 0 4.67s 204 431 0
Claude Sonnet 5 3.0 10.0 0.0% 0 4.31s 258 391 0

দ্রুত তুলনা

তুলনার জুটি বদলান