নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Poolside: Laguna XS 2.1 vs xAI: Grok 4.20

সারাংশ

Laguna XS 2.1 vs Grok 4.20 benchmark তুলনা: Laguna XS 2.1 average score-এ এগিয়ে: 5.3 vs 4.4. Laguna XS 2.1-এর benchmark খরচ কম: $0.003 vs $0.057. Laguna XS 2.1 দ্রুত: 722ms vs 1.11s, pass rates 31.8% vs 28.6%.

প্রস্তাবিত মডেল: Laguna XS 2.1 - It has the best score here (5.3), while costing about 19.6x less than Grok 4.20.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-02

মেট্রিক Laguna XS 2.1 Laguna XS 2.1 none প্রকাশ: 2026-07-02 বিনামূল্যে উপলভ্য Grok 4.20 Grok 4.20 none প্রকাশ: 2026-03-31
স্কোর 5.3 4.4
র‍্যাঙ্ক #128 #160
নির্ভরযোগ্যতা 10.0 প্রযোজ্য নয়
ধারাবাহিকতা 9.0 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 31.8% 28.6%
অস্থির টেস্ট 3 0
মোট রান 63 54
প্রতি ফলাফলে খরচ 0.058 1.570
মোট খরচ $0.003 $0.057
ইনপুট মূল্য $0.060 / 1M $1.250 / 1M
আউটপুট মূল্য $0.120 / 1M $2.500 / 1M
মোট ইনপুট টোকেন 41,148 41,313
আউটপুট টোকেন 3,451 1,923
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 722ms 1.11s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 2.30s 6.04s
প্রতিক্রিয়া সময় (মোট) 15.17s 19.96s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#128 Laguna XS 2.1

none
খরচ
$0.001
সময়
27.6s
টোকেন
4,344 tok

#160 xAI: Grok 4.20

none
খরচ
$0.004
সময়
6.5s
টোকেন
1,367 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna XS 2.1 5.3 8.3 33.3% 1 755ms 774 1,015 0
Grok 4.20 4.8 10.0 25.0% 0 501ms 1,986 267 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna XS 2.1 4.3 7.8 22.2% 1 623ms 7,995 562 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna XS 2.1 3.0 10.0 0.0% 0 1.76s 14,197 402 0
Grok 4.20 3.0 10.0 0.0% 0 6.04s 17,673 282 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna XS 2.1 10.0 10.0 100.0% 0 768ms 7,734 240 0
Grok 4.20 10.0 10.0 100.0% 0 522ms 7,749 207 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna XS 2.1 5.3 10.0 33.3% 0 364ms 834 14 0
Grok 4.20 3.0 10.0 0.0% 0 687ms 1,746 325 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna XS 2.1 5.0 10.0 0.0% 0 529ms 537 128 0
Grok 4.20 4.8 10.0 0.0% 0 659ms 819 83 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna XS 2.1 3.8 5.8 33.3% 1 364ms 638 50 0
Grok 4.20 6.3 10.0 50.0% 0 445ms 1,350 60 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna XS 2.1 3.0 10.0 0.0% 0 1.01s 771 730 0
Grok 4.20 5.3 10.0 33.3% 0 473ms 1,671 198 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna XS 2.1 10.0 10.0 100.0% 0 1.36s 7,413 300 0
Grok 4.20 10.0 10.0 100.0% 0 4.63s 7,245 189 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna XS 2.1 3.0 10.0 0.0% 0 254ms 255 10 0
Grok 4.20 0.0 0.0 0.0% 0 0ms 0 0 0

দ্রুত তুলনা

তুলনার জুটি বদলান