নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs Owl Alpha

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-04-30

মেট্রিক Mercury 2 Mercury 2 medium প্রকাশ: 2026-02-24 Owl Alpha Owl Alpha none প্রকাশ: 2026-04-30
স্কোর 6.5 6.0
র‍্যাঙ্ক #71 #87
নির্ভরযোগ্যতা প্রযোজ্য নয় 10.0
ধারাবাহিকতা 8.6 9.1
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.7% 46.3%
অস্থির টেস্ট 3 2
মোট রান 54 54
প্রতি ফলাফলে খরচ 0.580 0.000
মোট খরচ $0.047 $0.000
???? ??? $0.250 / 1M $0.000 / 1M
????? ??? $0.750 / 1M $0.000 / 1M
আউটপুট টোকেন 3,972 1,671
রিজনিং টোকেন 48,333 0
প্রতিক্রিয়া সময় (গড়) 2.21s 7.07s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 14.63s 32.27s
প্রতিক্রিয়া সময় (মোট) 37.51s 127.23s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 6.9 9.9 50.0% 0 1.12s 2,546 2,609
Owl Alpha 3.4 7.9 16.7% 1 2.78s 57 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.53s 249 2,213
Owl Alpha 10.0 10.0 100.0% 0 32.27s 450 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
Owl Alpha 3.0 10.0 0.0% 0 21.74s 315 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 7.3 5.9 83.3% 1 1.11s 183 1,656
Owl Alpha 10.0 10.0 100.0% 0 3.60s 246 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 2.9 7.2 11.1% 1 6.48s 41 30,754
Owl Alpha 5.3 10.0 33.3% 0 3.00s 27 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 4.8 10.0 0.0% 0 821ms 137 542
Owl Alpha 4.3 10.0 0.0% 0 4.61s 80 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
Owl Alpha 6.4 10.0 50.0% 0 2.63s 63 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.9 7.5 22.2% 1 934ms 354 2,758
Owl Alpha 5.9 7.2 55.6% 1 4.43s 202 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956
Owl Alpha 10.0 10.0 100.0% 0 22.78s 231 0

দ্রুত তুলনা

তুলনার জুটি বদলান