নেভিগেশন
AI BENCHY
Advertise here

KAT-Coder-Pro V2.5 (high) vs Qwen3.6 Plus (medium)

Qwen3.6 Plus (medium) average score-এ এগিয়ে: 7.8 vs 7.2. Qwen3.6 Plus (medium)-এর benchmark খরচ কম: $0.405 vs $0.482. KAT-Coder-Pro V2.5 (high) দ্রুত: 20.83s vs 43.12s, pass rates 63.6% vs 71.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#77
মোট আউটপুট টোকেন
136,164
প্রতিক্রিয়া সময় (গড়)
20.83s
মোট খরচ
$0.482
র‍্যাঙ্ক
#44
মোট আউটপুট টোকেন
191,237
প্রতিক্রিয়া সময় (গড়)
43.12s
মোট খরচ
$0.405
প্রস্তাবিত মডেল Qwen3.6 Plus (medium)

It has the strongest score in this comparison (7.8) and the best overall balance of cost and response time across all 2 models.

বিস্তারিত তুলনা

মেট্রিক KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 high প্রকাশ: 2026-07-14 Qwen3.6 Plus Qwen3.6 Plus medium প্রকাশ: 2026-04-20
স্কোর 7.2 7.8
র‍্যাঙ্ক #77 #44
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.8 9.3
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.6% 71.2%
অস্থির টেস্ট 6 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.378 1.514
মোট খরচ $0.482 $0.405
ইনপুট মূল্য $0.740 / 1M $0.325 / 1M
আউটপুট মূল্য $2.960 / 1M $1.950 / 1M
মোট ইনপুট টোকেন 106,076 97,689
আউটপুট টোকেন 9,071 6,412
রিজনিং টোকেন 127,093 184,825
প্রতিক্রিয়া সময় (গড়) 20.83s 43.12s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 199.97s 291.55s
প্রতিক্রিয়া সময় (মোট) 458.31s 905.53s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#77 KAT-Coder-Pro V2.5

high
খরচ
$0.009
সময়
26.4s
টোকেন
3,117 tok

#44 Qwen3.6 Plus

medium
খরচ
$0.024
সময়
219.0s
টোকেন
12,235 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
KAT-Coder-Pro V2.5 6.4 7.9 44.4% 1 22.00s 7,893 422 20,461
Qwen3.6 Plus 6.1 7.8 44.4% 1 153.12s 7,098 58 50,586

দ্রুত তুলনা

তুলনার জুটি বদলান