নেভিগেশন
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs xAI: Grok 4.20

Laguna S 2.1 average score-এ এগিয়ে: 4.5 vs 4.1. Laguna S 2.1-এর benchmark খরচ কম: $0.025 vs $0.057. Grok 4.20 দ্রুত: 1.11s vs 11.67s, pass rates 15.2% vs 27.3%.

প্রস্তাবিত মডেলLaguna S 2.1It has the best score here (4.5), while costing about 2.3x less than Grok 4.20.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Laguna S 2.1 Laguna S 2.1 none প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য Grok 4.20 Grok 4.20 none প্রকাশ: 2026-03-31
স্কোর 4.5 4.1
র‍্যাঙ্ক #200 #207
নির্ভরযোগ্যতা 10.0 প্রযোজ্য নয়
ধারাবাহিকতা 8.8 8.1
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 15.2% 27.3%
অস্থির টেস্ট 3 0
মোট রান 66 54
প্রতি ফলাফলে খরচ 1.205 1.570
মোট খরচ $0.025 $0.057
ইনপুট মূল্য $0.100 / 1M $1.250 / 1M
আউটপুট মূল্য $0.200 / 1M $2.500 / 1M
মোট ইনপুট টোকেন 125,598 41,313
আউটপুট টোকেন 57,634 1,923
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 11.67s 1.11s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 200.52s 6.04s
প্রতিক্রিয়া সময় (মোট) 256.80s 19.96s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#200 Laguna S 2.1

none
খরচ
$0.001
সময়
7.6s
টোকেন
1,345 tok

#207 xAI: Grok 4.20

none
খরচ
$0.004
সময়
6.5s
টোকেন
1,367 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 3.4 9.7 0.0% 0 550ms 7,917 424 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

দ্রুত তুলনা

তুলনার জুটি বদলান