নেভিগেশন
AI BENCHY
Advertise here

Claude Fable 5.1 (high) vs GPT-5.5 (medium)

average score প্রায় সমান: 9.0 vs 9.0. Claude Fable 5.1 (high)-এর benchmark খরচ কম: $3.364 vs $4.163. Claude Fable 5.1 (high) দ্রুত: 13.59s vs 38.97s, pass rates 89.4% vs 87.9%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-02

র‍্যাঙ্ক
#18
মোট আউটপুট টোকেন
40,071
প্রতিক্রিয়া সময় (গড়)
13.59s
মোট খরচ
$3.364
র‍্যাঙ্ক
#20
মোট আউটপুট টোকেন
125,316
প্রতিক্রিয়া সময় (গড়)
38.97s
মোট খরচ
$4.163
প্রস্তাবিত মডেল Claude Fable 5.1 (high)

It has the best score here (9.0), while responding about 2.9x faster than GPT-5.5 (medium).

বিস্তারিত তুলনা

মেট্রিক Claude Fable 5.1 Claude Fable 5.1 high প্রকাশ: 2026-09-02 GPT-5.5 GPT-5.5 medium প্রকাশ: 2026-04-24
স্কোর 9.0 9.0
র‍্যাঙ্ক #18 #20
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.9
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 89.4% 87.9%
অস্থির টেস্ট 1 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 17.701 23.127
মোট খরচ $3.364 $4.163
ইনপুট মূল্য $10.000 / 1M $5.000 / 1M
আউটপুট মূল্য $50.000 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 135,958 80,668
আউটপুট টোকেন 7,930 5,617
রিজনিং টোকেন 32,141 119,699
প্রতিক্রিয়া সময় (গড়) 13.59s 38.97s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 40.17s 332.10s
প্রতিক্রিয়া সময় (মোট) 298.90s 857.43s
প্যারামিটার ~9.5T মোট (~878B সক্রিয়) ~1.5T মোট (~100B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#18 Claude Fable 5.1

high
খরচ
$0.384
সময়
102.5s
টোকেন
7,824 tok

#20 GPT-5.5

medium
খরচ
$0.112
সময়
71.9s
টোকেন
3,807 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5.1 8.4 7.4 88.9% 1 13.91s 10,608 520 6,503
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

দ্রুত তুলনা

তুলনার জুটি বদলান