নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs OpenAI: GPT-5.4 Nano

average score প্রায় সমান: 7.5 vs 7.5. GPT-5.4 Nano (medium)-এর benchmark খরচ কম: $0.138 vs $1.550. Claude Opus 5 দ্রুত: 7.60s vs 13.24s, pass rates 57.6% vs 65.2%.

প্রস্তাবিত মডেলGPT-5.4 Nano (medium)It has the best score here (7.5), while costing about 11.2x less than Claude Opus 5.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 none প্রকাশ: 2026-07-25 GPT-5.4 Nano GPT-5.4 Nano medium প্রকাশ: 2026-03-17
স্কোর 7.5 7.5
র‍্যাঙ্ক #59 #61
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 57.6% 65.2%
অস্থির টেস্ট 1 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 12.912 1.150
মোট খরচ $1.550 $0.138
ইনপুট মূল্য $5.000 / 1M $0.200 / 1M
আউটপুট মূল্য $25.000 / 1M $1.250 / 1M
মোট ইনপুট টোকেন 185,550 82,819
আউটপুট টোকেন 24,866 7,100
রিজনিং টোকেন 0 90,022
প্রতিক্রিয়া সময় (গড়) 7.60s 13.24s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 47.72s 94.06s
প্রতিক্রিয়া সময় (মোট) 167.28s 291.33s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
খরচ
$0.271
সময়
149.3s
টোকেন
10,962 tok

#61 GPT-5.4 Nano

medium
খরচ
$0.007
সময়
24.6s
টোকেন
4,943 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778

দ্রুত তুলনা

তুলনার জুটি বদলান