নেভিগেশন
AI BENCHY
Advertise here

Anthropic: Claude Sonnet 5 vs OpenAI: GPT-5.4

GPT-5.4 (medium) average score-এ এগিয়ে: 8.5 vs 8.3. Claude Sonnet 5 (medium)-এর benchmark খরচ কম: $0.922 vs $1.533. Claude Sonnet 5 (medium) দ্রুত: 12.52s vs 23.10s, pass rates 80.3% vs 77.3%.

প্রস্তাবিত মডেলClaude Sonnet 5 (medium)Its score stays close to the best score here (8.3 vs 8.5), while costing about 1.7x less than GPT-5.4 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Claude Sonnet 5 Claude Sonnet 5 medium প্রকাশ: 2026-06-30 GPT-5.4 GPT-5.4 medium প্রকাশ: 2026-03-05
স্কোর 8.3 8.5
র‍্যাঙ্ক #26 #21
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.0 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 80.3% 77.3%
অস্থির টেস্ট 3 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 5.760 10.220
মোট খরচ $0.922 $1.533
ইনপুট মূল্য $2.000 / 1M $2.500 / 1M
আউটপুট মূল্য $10.000 / 1M $15.000 / 1M
মোট ইনপুট টোকেন 145,956 81,127
আউটপুট টোকেন 52,333 6,155
রিজনিং টোকেন 10,874 82,515
প্রতিক্রিয়া সময় (গড়) 12.52s 23.10s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 66.71s 100.41s
প্রতিক্রিয়া সময় (মোট) 275.42s 508.26s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#26 Claude Sonnet 5

medium
খরচ
$0.007
সময়
6.4s
টোকেন
832 tok

#21 GPT-5.4

medium
খরচ
$0.214
সময়
199.6s
টোকেন
14,349 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 5 9.0 7.9 88.9% 1 17.28s 10,590 13,153 2,379
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216

দ্রুত তুলনা

তুলনার জুটি বদলান