নেভিগেশন
Advertise here

Mercury 2.5 (medium) vs Qwen3.6 27B

average score প্রায় সমান: 6.4 vs 6.3. Mercury 2.5 (medium)-এর benchmark খরচ কম: $0.034 vs $0.147. Mercury 2.5 (medium) দ্রুত: 7.74s vs 12.71s, pass rates 63.8% vs 47.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#206
মোট আউটপুট টোকেন
138,946
প্রতিক্রিয়া সময় (গড়)
7.74s
মোট খরচ
$0.034
র‍্যাঙ্ক
#213
মোট আউটপুট টোকেন
20,816
প্রতিক্রিয়া সময় (গড়)
12.71s
মোট খরচ
$0.147
প্রস্তাবিত মডেল Mercury 2.5 (medium)

It has the best score here (6.4), while costing about 4.4x less than Qwen3.6 27B.

বিস্তারিত তুলনা

মেট্রিক Mercury 2.5 Mercury 2.5 medium প্রকাশ: 2026-09-08 Qwen3.6 27B Qwen3.6 27B none প্রকাশ: 2026-04-20
স্কোর 6.4 6.3
র‍্যাঙ্ক #206 #213
নির্ভরযোগ্যতা 9.7 10.0
ধারাবাহিকতা 8.3 7.7
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.8% 47.8%
অস্থির টেস্ট 5 6
মোট রান 69 69
প্রতি ফলাফলে খরচ 0.280 1.874
মোট খরচ $0.034 $0.147
ইনপুট মূল্য $0.040 / 1M $0.320 / 1M
আউটপুট মূল্য $0.150 / 1M $3.200 / 1M
মোট ইনপুট টোকেন 317,982 250,919
আউটপুট টোকেন 3,918 20,816
রিজনিং টোকেন 135,028 0
প্রতিক্রিয়া সময় (গড়) 7.74s 12.71s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 107.89s 156.31s
প্রতিক্রিয়া সময় (মোট) 178.07s 292.29s
প্যারামিটার ~100B 27B
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#206 Mercury 2.5

medium
খরচ
$0.001
সময়
3.8s
টোকেন
3,386 tok

#213 Qwen3.6 27B

none
খরচ
$0.009
সময়
83.0s
টোকেন
4,549 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2.5 5.0 5.1 44.5% 2 3.70s 7,807 488 21,857
Qwen3.6 27B 5.5 10.0 33.3% 0 4.16s 7,913 539 0

দ্রুত তুলনা

তুলনার জুটি বদলান