নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.4 Mini

Claude Opus 5 average score-এ এগিয়ে: 7.5 vs 7.5. GPT-5.4 Mini (medium)-এর benchmark খরচ কম: $0.756 vs $1.550. Claude Opus 5 দ্রুত: 7.60s vs 25.94s, pass rates 57.6% vs 71.2%.

প্রস্তাবিত মডেলClaude Opus 5It has the best score here (7.5), while responding about 3.4x faster than GPT-5.4 Mini (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 none প্রকাশ: 2026-07-25 GPT-5.4 Mini GPT-5.4 Mini medium প্রকাশ: 2026-03-17
স্কোর 7.5 7.5
র‍্যাঙ্ক #59 #64
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 7.7
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 57.6% 71.2%
অস্থির টেস্ট 1 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 12.912 6.299
মোট খরচ $1.550 $0.756
ইনপুট মূল্য $5.000 / 1M $0.750 / 1M
আউটপুট মূল্য $25.000 / 1M $4.500 / 1M
মোট ইনপুট টোকেন 185,550 97,155
আউটপুট টোকেন 24,866 6,211
রিজনিং টোকেন 0 145,544
প্রতিক্রিয়া সময় (গড়) 7.60s 25.94s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 47.72s 138.75s
প্রতিক্রিয়া সময় (মোট) 167.28s 570.66s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
খরচ
$0.271
সময়
149.3s
টোকেন
10,962 tok

#64 GPT-5.4 Mini

medium
খরচ
$0.056
সময়
95.5s
টোকেন
12,464 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902

দ্রুত তুলনা

তুলনার জুটি বদলান