নেভিগেশন
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs xAI: Grok 4.20

Laguna S 2.1 (low) average score-এ এগিয়ে: 5.0 vs 4.1. Grok 4.20-এর benchmark খরচ কম: $0.057 vs $0.091. Grok 4.20 দ্রুত: 1.11s vs 85.35s, pass rates 25.8% vs 27.3%.

প্রস্তাবিত মডেলLaguna S 2.1 (low)It has the strongest score in this comparison (5.0) and the best overall balance of cost and response time across all 2 models.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Laguna S 2.1 Laguna S 2.1 low প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য Grok 4.20 Grok 4.20 none প্রকাশ: 2026-03-31
স্কোর 5.0 4.1
র‍্যাঙ্ক #187 #213
নির্ভরযোগ্যতা 9.9 প্রযোজ্য নয়
ধারাবাহিকতা 7.8 8.1
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 25.8% 27.3%
অস্থির টেস্ট 6 0
মোট রান 66 54
প্রতি ফলাফলে খরচ 3.022 1.570
মোট খরচ $0.091 $0.057
ইনপুট মূল্য $0.100 / 1M $1.250 / 1M
আউটপুট মূল্য $0.200 / 1M $2.500 / 1M
মোট ইনপুট টোকেন 118,746 41,313
আউটপুট টোকেন 67,823 1,923
রিজনিং টোকেন 383,885 0
প্রতিক্রিয়া সময় (গড়) 85.35s 1.11s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 814.73s 6.04s
প্রতিক্রিয়া সময় (মোট) 1877.64s 19.96s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#187 Laguna S 2.1

low
খরচ
$0.001
সময়
6.6s
টোকেন
1,314 tok

#213 xAI: Grok 4.20

none
খরচ
$0.004
সময়
6.5s
টোকেন
1,367 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

দ্রুত তুলনা

তুলনার জুটি বদলান