নেভিগেশন
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Z.ai: GLM 5.1

GLM 5.1 average score-এ এগিয়ে: 5.5 vs 5.4. Laguna S 2.1 (medium)-এর benchmark খরচ কম: $0.059 vs $0.164. GLM 5.1 দ্রুত: 6.70s vs 58.43s, pass rates 25.8% vs 40.9%.

প্রস্তাবিত মডেলGLM 5.1It has the best score here (5.5), while responding about 8.7x faster than Laguna S 2.1 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Laguna S 2.1 Laguna S 2.1 medium প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য GLM 5.1 GLM 5.1 none প্রকাশ: 2026-04-07
স্কোর 5.4 5.5
র‍্যাঙ্ক #164 #157
নির্ভরযোগ্যতা 9.8 10.0
ধারাবাহিকতা 8.4 8.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 25.8% 40.9%
অস্থির টেস্ট 4 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.451 2.368
মোট খরচ $0.059 $0.164
ইনপুট মূল্য $0.100 / 1M $0.966 / 1M
আউটপুট মূল্য $0.200 / 1M $3.036 / 1M
মোট ইনপুট টোকেন 86,641 124,209
আউটপুট টোকেন 97,298 14,393
রিজনিং টোকেন 242,297 0
প্রতিক্রিয়া সময় (গড়) 58.43s 6.70s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 560.31s 61.20s
প্রতিক্রিয়া সময় (মোট) 1285.48s 147.38s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
খরচ
$0.001
সময়
4.0s
টোকেন
867 tok

#157 GLM 5.1

none
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
GLM 5.1 3.9 9.7 0.0% 0 4.96s 7,256 525 0

দ্রুত তুলনা

তুলনার জুটি বদলান