নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 4.7 (medium) vs Qwen3.8 Max (low)

average score প্রায় সমান: 8.7 vs 8.7. Qwen3.8 Max (low)-এর benchmark খরচ কম: $0.687 vs $1.477. Claude Opus 4.7 (medium) দ্রুত: 7.61s vs 21.19s, pass rates 83.3% vs 84.9%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-04

র‍্যাঙ্ক
#22
মোট আউটপুট টোকেন
29,990
প্রতিক্রিয়া সময় (গড়)
7.61s
মোট খরচ
$1.477
র‍্যাঙ্ক
#23
মোট আউটপুট টোকেন
81,411
প্রতিক্রিয়া সময় (গড়)
21.19s
মোট খরচ
$0.687
প্রস্তাবিত মডেল Qwen3.8 Max (low)

It has the best score here (8.7), while costing about 2.1x less than Claude Opus 4.7 (medium).

বিস্তারিত তুলনা

মেট্রিক Claude Opus 4.7 Claude Opus 4.7 medium প্রকাশ: 2026-04-16 Qwen3.8 Max Qwen3.8 Max low প্রকাশ: 2026-08-04
স্কোর 8.7 8.7
র‍্যাঙ্ক #22 #23
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 9.0
বেঞ্চমার্ক কভারেজ 22/22 টেস্ট · 66/66 প্রচেষ্টা 22/22 টেস্ট · 66/66 প্রচেষ্টা
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 83.3% 84.9%
অস্থির টেস্ট 1 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.201 4.041
মোট খরচ $1.477 $0.687
ইনপুট মূল্য $5.000 / 1M $2.000 / 1M
আউটপুট মূল্য $25.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 145,252 99,172
আউটপুট টোকেন 24,948 6,132
রিজনিং টোকেন 5,042 75,279
প্রতিক্রিয়া সময় (গড়) 7.61s 21.19s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 65.40s 155.75s
প্রতিক্রিয়া সময় (মোট) 159.91s 466.14s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#22 Claude Opus 4.7

medium
খরচ
$0.059
সময়
26.8s
টোকেন
2,475 tok

#23 Qwen3.8 Max

low
খরচ
$0.026
সময়
68.5s
টোকেন
4,280 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Qwen3.8 Max 8.4 7.4 88.9% 1 28.69s 8,127 512 15,952

দ্রুত তুলনা

তুলনার জুটি বদলান