নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Fable 5 vs OpenAI: GPT-5.5

সারাংশ

GPT-5.5 (low) average score-এ এগিয়ে: 9.3 vs 9.2. GPT-5.5 (low)-এর benchmark খরচ কম: $0.907 vs $3.165. GPT-5.5 (low) দ্রুত: 9.76s vs 17.01s, pass rates 82.5% vs 85.7%.

প্রস্তাবিত মডেলGPT-5.5 (low)It has the best score here (9.3), while costing about 3.5x less than Claude Fable 5 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-14

মেট্রিক Claude Fable 5 Claude Fable 5 medium প্রকাশ: 2026-06-10 GPT-5.5 GPT-5.5 low প্রকাশ: 2026-04-24
স্কোর 9.2 9.3
র‍্যাঙ্ক #9 #7
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 82.5% 85.7%
অস্থির টেস্ট 1 0
মোট রান 63 63
প্রতি ফলাফলে খরচ 18.614 5.035
মোট খরচ $3.165 $0.907
ইনপুট মূল্য $10.000 / 1M $5.000 / 1M
আউটপুট মূল্য $50.000 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 58,383 34,209
আউটপুট টোকেন 41,340 2,046
রিজনিং টোকেন 10,269 22,460
প্রতিক্রিয়া সময় (গড়) 17.01s 9.76s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 80.80s 56.19s
প্রতিক্রিয়া সময় (মোট) 357.17s 204.92s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 Claude Fable 5

medium
খরচ
$0.606
সময়
156.7s
টোকেন
12,264 tok

#7 GPT-5.5

low
খরচ
$0.068
সময়
37.0s
টোকেন
2,339 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5 10.0 10.0 100.0% 0 15.59s 10,590 7,383 1,318
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

দ্রুত তুলনা

তুলনার জুটি বদলান