নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 4.7 (medium) vs Qwen3.7 Max

Claude Opus 4.7 (medium) average score-এ এগিয়ে: 8.7 vs 7.4. Qwen3.7 Max-এর benchmark খরচ কম: $0.197 vs $1.477. Qwen3.7 Max দ্রুত: 4.52s vs 7.61s, pass rates 83.3% vs 68.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#20
মোট আউটপুট টোকেন
29,990
প্রতিক্রিয়া সময় (গড়)
7.61s
মোট খরচ
$1.477
র‍্যাঙ্ক
#67
মোট আউটপুট টোকেন
12,446
প্রতিক্রিয়া সময় (গড়)
4.52s
মোট খরচ
$0.197
প্রস্তাবিত মডেল Qwen3.7 Max

It offers the best overall trade-off: a competitive score (7.4), lower cost than Claude Opus 4.7 (medium), and balanced response time.

বিস্তারিত তুলনা

মেট্রিক Claude Opus 4.7 Claude Opus 4.7 medium প্রকাশ: 2026-04-16 Qwen3.7 Max Qwen3.7 Max none প্রকাশ: 2026-05-22
স্কোর 8.7 7.4
র‍্যাঙ্ক #20 #67
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 9.6 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 83.3% 68.2%
অস্থির টেস্ট 1 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.201 1.582
মোট খরচ $1.477 $0.197
ইনপুট মূল্য $5.000 / 1M $1.475 / 1M
আউটপুট মূল্য $25.000 / 1M $4.425 / 1M
মোট ইনপুট টোকেন 145,252 95,983
আউটপুট টোকেন 24,948 12,446
রিজনিং টোকেন 5,042 0
প্রতিক্রিয়া সময় (গড়) 7.61s 4.52s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 65.40s 72.30s
প্রতিক্রিয়া সময় (মোট) 159.91s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#20 Claude Opus 4.7

medium
খরচ
$0.059
সময়
26.8s
টোকেন
2,475 tok

#67 Qwen3.7 Max

none
খরচ
$0.046
সময়
195.0s
টোকেন
12,171 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

দ্রুত তুলনা

তুলনার জুটি বদলান