নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs Qwen: Qwen3.6 35B A3B

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-04-27

মেট্রিক Mercury 2 Mercury 2 medium প্রকাশ: 2026-02-24 Qwen3.6 35B A3B Qwen3.6 35B A3B none প্রকাশ: 2026-04-20
স্কোর 6.5 5.1
র‍্যাঙ্ক #71 #112
নির্ভরযোগ্যতা প্রযোজ্য নয় 10.0
ধারাবাহিকতা 8.6 7.4
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.7% 39.6%
অস্থির টেস্ট 3 5
মোট রান 54 54
প্রতি ফলাফলে খরচ 0.580 0.471
মোট খরচ $0.047 $0.019
???? ??? $0.250 / 1M $0.162 / 1M
????? ??? $0.750 / 1M $0.966 / 1M
আউটপুট টোকেন 3,972 17,503
রিজনিং টোকেন 48,333 0
প্রতিক্রিয়া সময় (গড়) 2.21s 2.87s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 14.63s 12.46s
প্রতিক্রিয়া সময় (মোট) 37.51s 46.00s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 6.9 9.9 50.0% 0 1.12s 2,546 2,609
Qwen3.6 35B A3B 3.6 7.6 16.7% 1 2.10s 1,571 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.53s 249 2,213
Qwen3.6 35B A3B 10.0 10.0 100.0% 0 2.05s 921 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
Qwen3.6 35B A3B 0.0 0.0 0.0% 0 0ms 0 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 7.3 5.9 83.3% 1 1.11s 183 1,656
Qwen3.6 35B A3B 10.0 10.0 100.0% 0 1.46s 248 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 2.9 7.2 11.1% 1 6.48s 41 30,754
Qwen3.6 35B A3B 3.5 4.4 33.3% 2 7.45s 11,381 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 4.8 10.0 0.0% 0 821ms 137 542
Qwen3.6 35B A3B 4.4 3.0 33.3% 1 3.51s 1,545 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
Qwen3.6 35B A3B 6.2 5.8 66.7% 1 1.86s 1,264 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.9 7.5 22.2% 1 934ms 354 2,758
Qwen3.6 35B A3B 3.2 9.9 0.0% 0 1.00s 573 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956
Qwen3.6 35B A3B 0.0 0.0 0.0% 0 0ms 0 0

দ্রুত তুলনা

তুলনার জুটি বদলান