নেভিগেশন
AI BENCHY
তুলনা করুন চার্ট Poddhoti
❤️ Made by XCS
Your ad here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Inception: Mercury 2

তুলনা করুন:

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-03-05

মেট্রিক Anthropic: Claude Sonnet 4.6 none প্রকাশ: 2026-02-17 Inception: Mercury 2 medium প্রকাশ: 2026-02-24
গড় স্কোর 6.9 5.4
র‍্যাঙ্ক #25 #35
সঠিক টেস্ট
ধারাবাহিকতা 10.0 8.3
প্রতি ফলাফলে খরচ 2.460 0.622
মোট খরচ $0.246 $0.044
প্রতি চেষ্টায় পাস রেট 66.7% 57.8%
অস্থির টেস্ট 0 3
common.totalRuns 45 (15 x 3) 45 (15 x 3)
আউটপুট টোকেন 6,703 3,571
রিজনিং টোকেন 0 45,379
প্রতিক্রিয়া সময় (গড়) 5.94s 2.47s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 23.84s 14.63s
প্রতিক্রিয়া সময় (মোট) 47.55s 34.56s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

গড় স্কোর vs প্রতিক্রিয়া সময় (গড়)

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Anthropic: Claude Sonnet 4.6 4.0 10.0 33.3% 0 4.83s 1,199 0
Inception: Mercury 2 7.3 9.8 66.7% 0 1.30s 2,531 2,410
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Anthropic: Claude Sonnet 4.6 9.0 10.0 100.0% 0 23.84s 3,766 0
Inception: Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Anthropic: Claude Sonnet 4.6 9.9 10.0 100.0% 0 3.43s 252 0
Inception: Mercury 2 5.5 5.9 83.3% 1 1.11s 183 1,656
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Anthropic: Claude Sonnet 4.6 7.0 10.0 66.7% 0 3.54s 413 0
Inception: Mercury 2 10.0 7.2 11.1% 1 6.48s 41 30,754
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Anthropic: Claude Sonnet 4.6 5.5 10.0 50.0% 0 1.96s 90 0
Inception: Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
Puzzle Solving স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Anthropic: Claude Sonnet 4.6 7.0 10.0 66.7% 0 2.92s 536 0
Inception: Mercury 2 1.7 7.5 22.2% 1 934ms 354 2,758
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Anthropic: Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 447 0
Inception: Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956

দ্রুত তুলনা

তুলনার জুটি বদলান