নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs OpenAI: GPT-5.5

সারাংশ

Claude Opus 4.7 vs GPT-5.5 benchmark তুলনা: GPT-5.5 average score-এ এগিয়ে: 9.0 vs 7.4. Claude Opus 4.7-এর benchmark খরচ কম: $0.505 vs $3.679. Claude Opus 4.7 দ্রুত: 3.02s vs 37.98s, pass rates 76.2% vs 87.3%.

প্রস্তাবিত মডেল: Claude Opus 4.7 - It offers the best overall trade-off: a competitive score (7.4), lower cost than GPT-5.5, and balanced response time.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-18

মেট্রিক Claude Opus 4.7 Claude Opus 4.7 none প্রকাশ: 2026-04-16 GPT-5.5 GPT-5.5 medium প্রকাশ: 2026-04-24
স্কোর 7.4 9.0
র‍্যাঙ্ক #49 #9
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.0 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 76.2% 87.3%
অস্থির টেস্ট 0 3
মোট রান 57 63
প্রতি ফলাফলে খরচ 3.154 21.638
মোট খরচ $0.505 $3.679
ইনপুট মূল্য $5.000 / 1M $5.000 / 1M
আউটপুট মূল্য $25.000 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 69,576 34,212
আউটপুট টোকেন 6,265 1,985
রিজনিং টোকেন 0 114,925
প্রতিক্রিয়া সময় (গড়) 3.02s 37.98s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 18.27s 332.10s
প্রতিক্রিয়া সময় (মোট) 57.44s 797.60s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#49 Claude Opus 4.7

none
খরচ
$0.051
সময়
24.2s
টোকেন
2,181 tok

#9 GPT-5.5

medium
খরচ
$0.112
সময়
71.9s
টোকেন
3,807 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 8.3 10.0 75.0% 0 2.12s 894 522 0
GPT-5.5 10.0 10.0 100.0% 0 4.66s 606 250 1,335
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 3.3 3.3 33.3% 0 2.84s 1,176 494 0
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 9.5 10.0 100.0% 0 18.27s 37,740 3,504 0
GPT-5.5 10.0 10.0 100.0% 0 19.29s 11,019 312 2,841
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 10.0 10.0 100.0% 0 2.15s 10,533 324 0
GPT-5.5 10.0 10.0 100.0% 0 4.18s 7,140 234 593
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 7.7 10.0 66.7% 0 1.19s 1,020 78 0
GPT-5.5 5.3 7.2 44.4% 1 164.14s 723 67 79,625
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 10.0 10.0 100.0% 0 3.47s 723 257 0
GPT-5.5 10.0 10.0 100.0% 0 4.16s 477 138 223
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 10.0 10.0 100.0% 0 1.46s 939 114 0
GPT-5.5 10.0 10.0 100.0% 0 3.36s 660 93 538
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 10.0 10.0 100.0% 0 2.46s 939 597 0
GPT-5.5 10.0 10.0 100.0% 0 6.76s 642 241 2,225
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 10.0 10.0 100.0% 0 4.74s 15,339 372 0
GPT-5.5 10.0 10.0 100.0% 0 10.57s 5,445 258 832
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 3.0 10.0 0.0% 0 1.46s 273 3 0
GPT-5.5 2.8 1.6 33.3% 1 37.86s 195 30 1,754

দ্রুত তুলনা

তুলনার জুটি বদলান