নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs OpenAI: GPT-5.5

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-05-28

মেট্রিক Claude Opus 4.8 Claude Opus 4.8 medium প্রকাশ: 2026-05-28 GPT-5.5 GPT-5.5 low প্রকাশ: 2026-04-24
স্কোর 8.7 8.9
র‍্যাঙ্ক #12 #8
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 83.3% 85.0%
অস্থির টেস্ট 1 0
মোট রান 60 60
প্রতি ফলাফলে খরচ 6.285 4.833
মোট খরচ $1.006 $0.822
ইনপুট মূল্য $5.000 / 1M $5.000 / 1M
আউটপুট মূল্য $25.000 / 1M $30.000 / 1M
আউটপুট টোকেন 23,201 2,025
রিজনিং টোকেন 5,901 20,092
প্রতিক্রিয়া সময় (গড়) 9.34s 9.43s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 38.03s 56.19s
প্রতিক্রিয়া সময় (মোট) 186.84s 188.66s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 10.0 10.0 100.0% 0 3.95s 1,179 478
GPT-5.5 10.0 10.0 100.0% 0 4.41s 238 1,020
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 10.0 10.0 100.0% 0 14.97s 6,651 1,381
GPT-5.5 10.0 10.0 100.0% 0 14.42s 402 4,034
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 9.8 10.0 100.0% 0 38.03s 5,260 1,588
GPT-5.5 10.0 10.0 100.0% 0 9.56s 303 717
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 7.1 5.6 83.3% 1 12.29s 481 312
GPT-5.5 10.0 10.0 100.0% 0 3.28s 228 157
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 5.3 10.0 33.3% 0 14.15s 7,477 900
GPT-5.5 5.3 10.0 33.3% 0 28.05s 69 11,609
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 10.0 10.0 100.0% 0 2.46s 237 0
GPT-5.5 10.0 10.0 100.0% 0 5.17s 133 245
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 10.0 10.0 100.0% 0 3.32s 373 320
GPT-5.5 9.9 10.0 100.0% 0 3.74s 93 415
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 10.0 10.0 100.0% 0 3.95s 791 483
GPT-5.5 10.0 10.0 100.0% 0 4.74s 279 954
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 10.0 10.0 100.0% 0 8.96s 301 225
GPT-5.5 10.0 10.0 100.0% 0 4.96s 250 101
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 3.0 10.0 0.0% 0 6.14s 451 214
GPT-5.5 3.0 10.0 0.0% 0 10.06s 30 840

দ্রুত তুলনা

তুলনার জুটি বদলান