নেভিগেশন
AI BENCHY
Advertise here

Anthropic: Claude Opus 4.7 vs Anthropic: Claude Sonnet 4.6

Claude Opus 4.7 (medium) average score-এ এগিয়ে: 8.7 vs 7.8. Claude Opus 4.7 (medium)-এর benchmark খরচ কম: $1.477 vs $2.057. Claude Opus 4.7 (medium) দ্রুত: 7.61s vs 25.91s, pass rates 83.3% vs 66.7%.

প্রস্তাবিত মডেলClaude Opus 4.7 (medium)It has the best score here (8.7), while responding about 3.4x faster than Claude Sonnet 4.6 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক Claude Opus 4.7 Claude Opus 4.7 medium প্রকাশ: 2026-04-16 Claude Sonnet 4.6 Claude Sonnet 4.6 medium প্রকাশ: 2026-02-17
স্কোর 8.7 7.8
র‍্যাঙ্ক #15 #40
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 83.3% 66.7%
অস্থির টেস্ট 1 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.201 14.692
মোট খরচ $1.477 $2.057
ইনপুট মূল্য $5.000 / 1M $3.000 / 1M
আউটপুট মূল্য $25.000 / 1M $15.000 / 1M
মোট ইনপুট টোকেন 145,252 106,292
আউটপুট টোকেন 24,948 80,748
রিজনিং টোকেন 5,042 35,117
প্রতিক্রিয়া সময় (গড়) 7.61s 25.91s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 65.40s 140.96s
প্রতিক্রিয়া সময় (মোট) 159.91s 362.78s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#15 Claude Opus 4.7

medium
খরচ
$0.059
সময়
26.8s
টোকেন
2,475 tok

#40 Claude Sonnet 4.6

medium
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Claude Sonnet 4.6 5.7 6.6 44.4% 1 33.29s 6,995 16,089 3,686

দ্রুত তুলনা

তুলনার জুটি বদলান