নেভিগেশন
AI BENCHY
Your ad here

AI BENCHY Compare

Inception: Mercury 2 vs Qwen: Qwen3.6 Flash

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-04-27

মেট্রিক Mercury 2 Mercury 2 medium প্রকাশ: 2026-02-24 Qwen3.6 Flash Qwen3.6 Flash none প্রকাশ: 2026-04-20
স্কোর 6.5 5.8
র‍্যাঙ্ক #71 #90
নির্ভরযোগ্যতা প্রযোজ্য নয় 10.0
ধারাবাহিকতা 8.6 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.7% 38.9%
অস্থির টেস্ট 3 0
মোট রান 54 54
প্রতি ফলাফলে খরচ 0.580 0.250
মোট খরচ $0.047 $0.018
???? ??? $0.250 / 1M $0.250 / 1M
????? ??? $0.750 / 1M $1.500 / 1M
আউটপুট টোকেন 3,972 4,161
রিজনিং টোকেন 48,333 0
প্রতিক্রিয়া সময় (গড়) 2.21s 1.65s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 14.63s 4.60s
প্রতিক্রিয়া সময় (মোট) 37.51s 29.78s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 6.9 9.9 50.0% 0 1.12s 2,546 2,609
Qwen3.6 Flash 3.1 10.0 0.0% 0 1.63s 1,554 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.53s 249 2,213
Qwen3.6 Flash 10.0 10.0 100.0% 0 2.23s 867 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
Qwen3.6 Flash 3.0 10.0 0.0% 0 4.22s 315 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 7.3 5.9 83.3% 1 1.11s 183 1,656
Qwen3.6 Flash 10.0 10.0 100.0% 0 2.13s 243 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 2.9 7.2 11.1% 1 6.48s 41 30,754
Qwen3.6 Flash 5.3 10.0 33.3% 0 1.11s 15 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 4.8 10.0 0.0% 0 821ms 137 542
Qwen3.6 Flash 10.0 10.0 100.0% 0 947ms 132 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
Qwen3.6 Flash 6.3 10.0 50.0% 0 1.10s 66 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.9 7.5 22.2% 1 934ms 354 2,758
Qwen3.6 Flash 3.5 10.0 0.0% 0 1.20s 697 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956
Qwen3.6 Flash 10.0 10.0 100.0% 0 2.49s 272 0

দ্রুত তুলনা

তুলনার জুটি বদলান