নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs OpenAI: GPT-5.4

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-04

মেট্রিক Claude Opus 4.7 Claude Opus 4.7 medium প্রকাশ: 2026-04-16 GPT-5.4 GPT-5.4 medium প্রকাশ: 2026-03-05
স্কোর 8.7 8.0
র‍্যাঙ্ক #11 #21
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 82.5% 76.2%
অস্থির টেস্ট 1 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 3.991 8.640
মোট খরচ $0.679 $1.210
ইনপুট মূল্য $5.000 / 1M $2.500 / 1M
আউটপুট মূল্য $25.000 / 1M $15.000 / 1M
মোট ইনপুট টোকেন 65,406 34,108
আউটপুট টোকেন 11,858 2,242
রিজনিং টোকেন 2,198 72,707
প্রতিক্রিয়া সময় (গড়) 4.73s 22.35s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 23.18s 100.41s
প্রতিক্রিয়া সময় (মোট) 94.51s 469.29s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 8.3 10.0 75.0% 0 1.85s 894 348 0
GPT-5.4 8.3 10.0 75.0% 0 4.11s 606 240 1,511
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 10.0 10.0 100.0% 0 21.45s 24,501 2,369 1,084
GPT-5.4 10.0 10.0 100.0% 0 20.57s 11,019 301 3,543
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 10.0 10.0 100.0% 0 2.37s 10,533 324 0
GPT-5.4 10.0 10.0 100.0% 0 5.32s 7,140 234 804
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 7.7 10.0 66.7% 0 1.17s 630 51 0
GPT-5.4 5.3 7.2 44.4% 1 74.27s 619 61 34,748
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 10.0 10.0 100.0% 0 2.87s 723 256 0
GPT-5.4 4.7 3.1 33.3% 1 4.92s 477 145 321
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 10.0 10.0 100.0% 0 1.57s 939 114 0
GPT-5.4 10.0 10.0 100.0% 0 3.11s 660 93 897
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 10.0 10.0 100.0% 0 2.43s 939 370 0
GPT-5.4 8.2 7.2 88.9% 1 9.14s 642 441 3,815
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 10.0 10.0 100.0% 0 4.17s 15,339 373 0
GPT-5.4 10.0 10.0 100.0% 0 13.28s 5,445 264 1,031
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 3.0 10.0 0.0% 0 2.25s 273 24 0
GPT-5.4 3.0 10.0 0.0% 0 13.95s 195 30 1,821

দ্রুত তুলনা

তুলনার জুটি বদলান