নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 4.8 vs Qwen3.7 Plus

Claude Opus 4.8 average score-এ এগিয়ে: 7.3 vs 7.2. Qwen3.7 Plus-এর benchmark খরচ কম: $0.106 vs $1.166. Claude Opus 4.8 দ্রুত: 4.91s vs 12.09s, pass rates 63.6% vs 50.0%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#74
মোট আউটপুট টোকেন
16,797
প্রতিক্রিয়া সময় (গড়)
4.91s
মোট খরচ
$1.166
র‍্যাঙ্ক
#79
মোট আউটপুট টোকেন
58,097
প্রতিক্রিয়া সময় (গড়)
12.09s
মোট খরচ
$0.106
প্রস্তাবিত মডেল Qwen3.7 Plus

Its score stays close to the best score here (7.2 vs 7.3), while costing about 11.0x less than Claude Opus 4.8.

বিস্তারিত তুলনা

মেট্রিক Claude Opus 4.8 Claude Opus 4.8 none প্রকাশ: 2026-05-28 Qwen3.7 Plus Qwen3.7 Plus none প্রকাশ: 2026-06-03
স্কোর 7.3 7.2
র‍্যাঙ্ক #74 #79
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.2 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.6% 50.0%
অস্থির টেস্ট 2 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.969 1.014
মোট খরচ $1.166 $0.106
ইনপুট মূল্য $5.000 / 1M $0.320 / 1M
আউটপুট মূল্য $25.000 / 1M $1.280 / 1M
মোট ইনপুট টোকেন 149,206 98,824
আউটপুট টোকেন 16,797 58,097
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 4.91s 12.09s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 35.03s 206.03s
প্রতিক্রিয়া সময় (মোট) 108.03s 265.89s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Claude Opus 4.8

none
খরচ
$0.053
সময়
22.0s
টোকেন
2,253 tok

#79 Qwen3.7 Plus

none
খরচ
$0.019
সময়
213.5s
টোকেন
11,960 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0

দ্রুত তুলনা

তুলনার জুটি বদলান