নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

Owl Alpha vs xAI: Grok 4.20

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-05-10

মেট্রিক Owl Alpha Owl Alpha none প্রকাশ: 2026-04-30 Grok 4.20 Grok 4.20 none প্রকাশ: 2026-03-31
স্কোর 5.8 5.4
র‍্যাঙ্ক #98 #115
নির্ভরযোগ্যতা 10.0 প্রযোজ্য নয়
ধারাবাহিকতা 9.1 9.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 43.9% 35.2%
অস্থির টেস্ট 2 1
মোট রান 57 54
প্রতি ফলাফলে খরচ 0.000 1.574
মোট খরচ $0.000 $0.095
???? ??? $0.000 / 1M $1.250 / 1M
????? ??? $0.000 / 1M $2.500 / 1M
আউটপুট টোকেন 1,685 1,967
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 6.83s 1.11s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 32.27s 6.04s
প্রতিক্রিয়া সময় (মোট) 129.73s 20.02s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Owl Alpha 3.4 7.9 16.7% 1 2.78s 57 0
Grok 4.20 4.8 10.0 25.0% 0 501ms 267 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Owl Alpha 10.0 10.0 100.0% 0 32.27s 450 0
Grok 4.20 3.4 9.3 0.0% 0 1.22s 312 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Owl Alpha 3.0 10.0 0.0% 0 21.74s 315 0
Grok 4.20 3.0 10.0 0.0% 0 6.04s 282 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Owl Alpha 10.0 10.0 100.0% 0 3.60s 246 0
Grok 4.20 10.0 10.0 100.0% 0 522ms 207 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Owl Alpha 5.3 10.0 33.3% 0 3.00s 27 0
Grok 4.20 3.0 10.0 0.0% 0 687ms 325 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Owl Alpha 4.3 10.0 0.0% 0 4.61s 80 0
Grok 4.20 4.8 10.0 0.0% 0 659ms 83 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Owl Alpha 6.4 10.0 50.0% 0 2.63s 63 0
Grok 4.20 6.3 10.0 50.0% 0 455ms 60 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Owl Alpha 5.9 7.2 55.6% 1 4.43s 202 0
Grok 4.20 5.3 7.2 44.4% 1 487ms 242 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Owl Alpha 10.0 10.0 100.0% 0 22.78s 231 0
Grok 4.20 10.0 10.0 100.0% 0 4.63s 189 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Owl Alpha 3.0 10.0 0.0% 0 2.50s 14 0
Grok 4.20 - - - - - - - -

দ্রুত তুলনা

তুলনার জুটি বদলান