নেভিগেশন
Advertise here

Claude Opus 4.8 (low) vs Qwen3.5-27B

average score প্রায় সমান: 7.2 vs 7.2. Qwen3.5-27B-এর benchmark খরচ কম: $0.116 vs $3.787. Qwen3.5-27B দ্রুত: 9.98s vs 17.13s, pass rates 78.3% vs 47.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#143
মোট আউটপুট টোকেন
69,489
প্রতিক্রিয়া সময় (গড়)
17.13s
মোট খরচ
$3.787
র‍্যাঙ্ক
#139
মোট আউটপুট টোকেন
36,422
প্রতিক্রিয়া সময় (গড়)
9.98s
মোট খরচ
$0.116
প্রস্তাবিত মডেল Claude Opus 4.8 (low)

It has the strongest score in this comparison (7.2) and the best overall balance of cost and response time across all 2 models.

বিস্তারিত তুলনা

মেট্রিক Claude Opus 4.8 Claude Opus 4.8 low প্রকাশ: 2026-05-28 Qwen3.5-27B Qwen3.5-27B none প্রকাশ: 2026-02-24
স্কোর 7.2 7.2
র‍্যাঙ্ক #143 #139
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.6 9.4
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 78.3% 47.8%
অস্থির টেস্ট 4 2
মোট রান 69 69
প্রতি ফলাফলে খরচ 23.669 1.153
মোট খরচ $3.787 $0.116
ইনপুট মূল্য $5.000 / 1M $0.195 / 1M
আউটপুট মূল্য $25.000 / 1M $1.560 / 1M
মোট ইনপুট টোকেন 409,947 283,977
আউটপুট টোকেন 46,060 36,422
রিজনিং টোকেন 23,429 0
প্রতিক্রিয়া সময় (গড়) 17.13s 9.98s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 127.97s 124.53s
প্রতিক্রিয়া সময় (মোট) 394.01s 229.52s
প্যারামিটার ~5T মোট (~500B সক্রিয়) 27B
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#143 Claude Opus 4.8

low
খরচ
$0.031
সময়
14.1s
টোকেন
1,345 tok

#139 Qwen3.5-27B

none
খরচ
$0.007
সময়
42.9s
টোকেন
4,273 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 6.6 4.6 77.8% 2 7.58s 10,590 3,637 809
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

দ্রুত তুলনা

তুলনার জুটি বদলান