নেভিগেশন
AI BENCHY
Your ad here

AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs xAI: Grok 4.20 Beta

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-03-12

মেট্রিক Kimi K2.5 Kimi K2.5 medium প্রকাশ: 2026-01-27 Grok 4.20 Beta Grok 4.20 Beta none প্রকাশ: 2026-03-12
র‍্যাঙ্ক #30 #52
গড় স্কোর 6.4 4.4
ধারাবাহিকতা 7.5 9.1
প্রতি ফলাফলে খরচ 2.171 2.214
মোট খরচ $0.196 $0.089
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.9% 33.3%
অস্থির টেস্ট 5 2
মোট রান 48 48
আউটপুট টোকেন 38,453 1,511
রিজনিং টোকেন 72,496 0
প্রতিক্রিয়া সময় (গড়) 69.83s 1.22s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 137.29s 6.48s
প্রতিক্রিয়া সময় (মোট) 628.45s 19.53s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

গড় স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

গড় স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.5 7.0 7.2 88.9% 1 85.28s 335 6,255
Grok 4.20 Beta 3.3 7.9 22.2% 1 562ms 245 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 703 3,713
Grok 4.20 Beta 10.0 10.0 0.0% 0 6.48s 282 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.5 9.9 10.0 100.0% 0 49.78s 563 7,940
Grok 4.20 Beta 9.9 10.0 100.0% 0 601ms 197 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.5 10.0 4.4 33.3% 2 137.29s 20,753 30,564
Grok 4.20 Beta 10.0 10.0 0.0% 0 611ms 160 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.5 6.0 3.4 66.7% 1 69.73s 3,815 4,262
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 87 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 5,371 6,547
Grok 4.20 Beta 4.5 10.0 0.0% 0 687ms 60 0
Puzzle Solving স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.5 4.0 7.3 44.4% 1 45.40s 6,671 12,403
Grok 4.20 Beta 4.0 7.2 55.6% 1 541ms 291 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 242 812
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 189 0

দ্রুত তুলনা

তুলনার জুটি বদলান