নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs Qwen: Qwen3.5-27B

সারাংশ

Claude Opus 4.8 vs Qwen3.5-27B benchmark তুলনা: Qwen3.5-27B average score-এ এগিয়ে: 7.9 vs 7.7. Qwen3.5-27B-এর benchmark খরচ কম: $0.536 vs $1.270. Claude Opus 4.8 দ্রুত: 10.83s vs 68.39s, pass rates 79.4% vs 73.0%.

প্রস্তাবিত মডেল: Claude Opus 4.8 - Its score stays close to the best score here (7.7 vs 7.9), while responding about 6.3x faster than Qwen3.5-27B.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-30

মেট্রিক Claude Opus 4.8 Claude Opus 4.8 low প্রকাশ: 2026-05-28 Qwen3.5-27B Qwen3.5-27B medium প্রকাশ: 2026-02-24
স্কোর 7.7 7.9
র‍্যাঙ্ক #38 #29
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.8 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 79.4% 73.0%
অস্থির টেস্ট 3 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 8.466 4.901
মোট খরচ $1.270 $0.536
ইনপুট মূল্য $5.000 / 1M $0.195 / 1M
আউটপুট মূল্য $25.000 / 1M $1.560 / 1M
মোট ইনপুট টোকেন 60,946 42,164
আউটপুট টোকেন 31,771 8,534
রিজনিং টোকেন 6,831 329,289
প্রতিক্রিয়া সময় (গড়) 10.83s 68.39s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 127.97s 234.36s
প্রতিক্রিয়া সময় (মোট) 227.39s 1436.24s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#38 Claude Opus 4.8

low
খরচ
$0.031
সময়
14.1s
টোকেন
1,345 tok

#29 Qwen3.5-27B

medium
খরচ
$0.008
সময়
62.0s
টোকেন
3,099 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 10.0 10.0 100.0% 0 3.30s 834 793 371
Qwen3.5-27B 8.7 7.9 91.7% 1 19.75s 672 569 31,505
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 6.6 4.6 77.8% 2 7.58s 10,590 3,637 809
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 9.8 10.0 100.0% 0 20.84s 23,500 2,216 1,081
Qwen3.5-27B 10.0 10.0 100.0% 0 163.96s 14,946 483 9,991
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 6.3 5.8 66.7% 1 2.27s 10,503 310 0
Qwen3.5-27B 10.0 10.0 100.0% 0 30.26s 7,782 270 16,150
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 5.3 10.0 33.3% 0 45.53s 975 23,311 3,908
Qwen3.5-27B 5.3 10.0 33.3% 0 79.53s 553 43 52,368
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 10.0 10.0 100.0% 0 2.55s 708 231 0
Qwen3.5-27B 6.1 3.1 66.7% 1 101.41s 524 70 23,147
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 9.8 10.0 100.0% 0 2.78s 909 111 221
Qwen3.5-27B 10.0 10.0 100.0% 0 19.66s 699 97 11,638
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 10.0 10.0 100.0% 0 3.01s 894 592 184
Qwen3.5-27B 8.2 7.7 77.8% 1 59.60s 696 242 70,096
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 10.0 10.0 100.0% 0 6.85s 11,775 370 35
Qwen3.5-27B 10.0 10.0 100.0% 0 7.45s 8,193 348 1,323
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 3.0 10.0 0.0% 0 5.48s 258 200 222
Qwen3.5-27B 3.0 10.0 0.0% 0 85.11s 204 31 23,683

দ্রুত তুলনা

তুলনার জুটি বদলান