নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Fable 5.1 (medium) vs Qwen3.8 27B (high)

Qwen3.8 27B (high) average score-এ এগিয়ে: 8.4 vs 8.3. Qwen3.8 27B (high)-এর benchmark খরচ কম: ~$0.287 vs $2.909. Claude Fable 5.1 (medium) দ্রুত: 11.67s vs 167.89s, pass rates 81.8% vs 77.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-02

র‍্যাঙ্ক
#48
মোট আউটপুট টোকেন
31,152
প্রতিক্রিয়া সময় (গড়)
11.67s
মোট খরচ
$2.909
র‍্যাঙ্ক
#44
মোট আউটপুট টোকেন
656,635
প্রতিক্রিয়া সময় (গড়)
167.89s
মোট খরচ
~$0.287
প্রস্তাবিত মডেল Qwen3.8 27B (high)

It has the best score here (8.4), while costing about 10.1x less than Claude Fable 5.1 (medium).

বিস্তারিত তুলনা

মেট্রিক Claude Fable 5.1 Claude Fable 5.1 medium প্রকাশ: 2026-09-02 Qwen3.8 27B Qwen3.8 27B high প্রকাশ: 2026-08-14
স্কোর 8.3 8.4
র‍্যাঙ্ক #48 #44
নির্ভরযোগ্যতা 10.0 9.6
ধারাবাহিকতা 7.8 9.2
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 81.8% 77.3%
অস্থির টেস্ট 6 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 19.392 ~1.792
মোট খরচ $2.909 ~$0.287
ইনপুট মূল্য $10.000 / 1M প্রযোজ্য নয়
আউটপুট মূল্য $50.000 / 1M প্রযোজ্য নয়
মোট ইনপুট টোকেন 135,112 100,179
আউটপুট টোকেন 7,594 904
রিজনিং টোকেন 23,558 655,731
প্রতিক্রিয়া সময় (গড়) 11.67s 167.89s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 36.59s 640.85s
প্রতিক্রিয়া সময় (মোট) 256.73s 3693.54s
প্যারামিটার ~9.5T মোট (~878B সক্রিয়) 27.3B
উপলভ্যতা বন্ধ উৎস ওজন উপলভ্য

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#48 Claude Fable 5.1

medium
খরচ
$0.244
সময়
65.9s
টোকেন
5,025 tok

#44 Qwen3.8 27B

high
খরচ
~$0.008
সময়
270.1s
টোকেন
18,963 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5.1 7.0 5.0 77.8% 2 10.99s 10,608 525 4,376
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

দ্রুত তুলনা

তুলনার জুটি বদলান

GPT-5.2mediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5lowClaude Fable 5.1mediumvsMuse Spark 1.1lowQwen3.8 27BhighvsGrok 4.6mediumMuse Spark 1.2lowvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5mediumMuse Spark 1.1lowvsQwen3.8 27BhighClaude Fable 5.1mediumvsInkling SmallhighClaude Fable 5.1mediumvsGrok 4.5lowGPT-5.4mediumvsQwen3.8 27BhighGemini 2.5 FlashmediumvsQwen3.8 27Bhigh