নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.6 vs OpenAI: GPT-5.4 Nano

সারাংশ

Claude Opus 4.6 vs GPT-5.4 Nano benchmark তুলনা: Claude Opus 4.6 average score-এ এগিয়ে: 7.7 vs 7.5. GPT-5.4 Nano-এর benchmark খরচ কম: $0.107 vs $2.053. GPT-5.4 Nano দ্রুত: 11.95s vs 25.89s, pass rates 61.9% vs 63.5%.

প্রস্তাবিত মডেল: GPT-5.4 Nano - Its score stays close to the best score here (7.5 vs 7.7), while costing about 19.3x less than Claude Opus 4.6.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-12

মেট্রিক Claude Opus 4.6 Claude Opus 4.6 medium প্রকাশ: 2026-02-05 GPT-5.4 Nano GPT-5.4 Nano medium প্রকাশ: 2026-03-17
স্কোর 7.7 7.5
র‍্যাঙ্ক #41 #48
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.8 8.4
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 61.9% 63.5%
অস্থির টেস্ট 3 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 17.103 0.969
মোট খরচ $2.053 $0.107
ইনপুট মূল্য $5.000 / 1M $0.200 / 1M
আউটপুট মূল্য $25.000 / 1M $1.250 / 1M
মোট ইনপুট টোকেন 53,227 35,434
আউটপুট টোকেন 47,446 3,014
রিজনিং টোকেন 24,000 76,520
প্রতিক্রিয়া সময় (গড়) 25.89s 11.95s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 83.40s 94.06s
প্রতিক্রিয়া সময় (মোট) 362.49s 250.98s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#41 Claude Opus 4.6

medium
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

#48 GPT-5.4 Nano

medium
Cost
$0.007
Time
24.6s
Tokens
4,943 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.6 6.4 5.8 66.7% 2 7.45s 840 986 1,071
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 606 683 2,254
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.6 5.7 7.1 44.4% 1 30.10s 8,522 13,057 4,121
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.6 10.0 10.0 100.0% 0 76.66s 20,685 8,178 5,194
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 12,345 349 5,719
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.6 10.0 10.0 100.0% 0 7.37s 8,676 691 757
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 7,140 234 516
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.6 3.0 10.0 0.0% 0 83.40s 674 14,642 8,687
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 619 60 43,325
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.6 10.0 10.0 100.0% 0 5.04s 564 188 292
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 477 179 443
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.6 10.0 10.0 100.0% 0 2.43s 792 266 467
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 660 95 521
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.6 7.7 10.0 66.7% 0 4.71s 816 532 630
GPT-5.4 Nano 4.1 7.2 22.2% 1 3.79s 642 594 1,408
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.6 10.0 10.0 100.0% 0 9.73s 11,454 861 329
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 5,445 234 382
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.6 3.0 10.0 0.0% 0 63.24s 204 8,045 2,452
GPT-5.4 Nano 3.0 10.0 0.0% 0 4.81s 195 70 1,174

দ্রুত তুলনা

তুলনার জুটি বদলান