নেভিগেশন
AI BENCHY
Advertise here

Claude Fable 5.1 (high) vs GPT-5.5 (low)

GPT-5.5 (low) average score-এ এগিয়ে: 9.3 vs 9.0. GPT-5.5 (low)-এর benchmark খরচ কম: $1.257 vs $3.364. GPT-5.5 (low) দ্রুত: 10.15s vs 13.59s, pass rates 89.4% vs 86.4%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-02

র‍্যাঙ্ক
#20
মোট আউটপুট টোকেন
40,071
প্রতিক্রিয়া সময় (গড়)
13.59s
মোট খরচ
$3.364
র‍্যাঙ্ক
#11
মোট আউটপুট টোকেন
28,540
প্রতিক্রিয়া সময় (গড়)
10.15s
মোট খরচ
$1.257
প্রস্তাবিত মডেল GPT-5.5 (low)

It has the best score here (9.3), while costing about 2.7x less than Claude Fable 5.1 (high).

বিস্তারিত তুলনা

মেট্রিক Claude Fable 5.1 Claude Fable 5.1 high প্রকাশ: 2026-09-02 GPT-5.5 GPT-5.5 low প্রকাশ: 2026-04-24
স্কোর 9.0 9.3
র‍্যাঙ্ক #20 #11
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 10.0
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 89.4% 86.4%
অস্থির টেস্ট 1 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 17.701 6.614
মোট খরচ $3.364 $1.257
ইনপুট মূল্য $10.000 / 1M $5.000 / 1M
আউটপুট মূল্য $50.000 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 135,958 80,067
আউটপুট টোকেন 7,930 5,378
রিজনিং টোকেন 32,141 23,162
প্রতিক্রিয়া সময় (গড়) 13.59s 10.15s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 40.17s 56.19s
প্রতিক্রিয়া সময় (মোট) 298.90s 223.24s
প্যারামিটার ~9.5T মোট (~878B সক্রিয়) ~1.5T মোট (~100B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#20 Claude Fable 5.1

high
খরচ
$0.384
সময়
102.5s
টোকেন
7,824 tok

#11 GPT-5.5

low
খরচ
$0.068
সময়
37.0s
টোকেন
2,339 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5.1 8.4 7.4 88.9% 1 13.91s 10,608 520 6,503
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

দ্রুত তুলনা

তুলনার জুটি বদলান