নেভিগেশন
AI BENCHY
Your ad here

AI BENCHY Compare

Inception: Mercury 2 vs Qwen: Qwen3.5-9B

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-04-26

মেট্রিক Mercury 2 Mercury 2 medium প্রকাশ: 2026-02-24 Qwen3.5-9B Qwen3.5-9B none প্রকাশ: 2026-03-02
স্কোর 6.5 4.8
র‍্যাঙ্ক #65 #105
নির্ভরযোগ্যতা প্রযোজ্য নয় প্রযোজ্য নয়
ধারাবাহিকতা 8.6 9.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.7% 24.1%
অস্থির টেস্ট 3 1
মোট রান 54 54
প্রতি ফলাফলে খরচ 0.580 0.116
মোট খরচ $0.047 $0.005
???? ??? $0.250 / 1M $0.100 / 1M
????? ??? $0.750 / 1M $0.150 / 1M
আউটপুট টোকেন 3,972 3,951
রিজনিং টোকেন 48,333 0
প্রতিক্রিয়া সময় (গড়) 2.21s 1.47s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 14.63s 5.91s
প্রতিক্রিয়া সময় (মোট) 37.51s 26.43s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 6.9 9.9 50.0% 0 1.12s 2,546 2,609
Qwen3.5-9B 3.1 9.9 0.0% 0 1.71s 582 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.53s 249 2,213
Qwen3.5-9B 5.2 3.4 33.3% 1 5.69s 1,006 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
Qwen3.5-9B 3.0 10.0 0.0% 0 5.91s 1,255 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 7.3 5.9 83.3% 1 1.11s 183 1,656
Qwen3.5-9B 10.0 10.0 100.0% 0 847ms 249 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 2.9 7.2 11.1% 1 6.48s 41 30,754
Qwen3.5-9B 3.0 10.0 0.0% 0 464ms 24 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 4.8 10.0 0.0% 0 821ms 137 542
Qwen3.5-9B 4.4 9.9 0.0% 0 552ms 99 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
Qwen3.5-9B 6.5 10.0 50.0% 0 514ms 75 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.9 7.5 22.2% 1 934ms 354 2,758
Qwen3.5-9B 3.2 9.9 0.0% 0 683ms 388 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956
Qwen3.5-9B 10.0 10.0 100.0% 0 1.27s 273 0

দ্রুত তুলনা

তুলনার জুটি বদলান