নেভিগেশন
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Z.ai: GLM 5.1

GLM 5.1 average score-এ এগিয়ে: 5.5 vs 5.4. Laguna S 2.1 (high)-এর benchmark খরচ কম: $0.127 vs $0.164. GLM 5.1 দ্রুত: 6.70s vs 111.61s, pass rates 27.3% vs 40.9%.

প্রস্তাবিত মডেলGLM 5.1It has the best score here (5.5), while responding about 16.7x faster than Laguna S 2.1 (high).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Laguna S 2.1 Laguna S 2.1 high প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য GLM 5.1 GLM 5.1 none প্রকাশ: 2026-04-07
স্কোর 5.4 5.5
র‍্যাঙ্ক #167 #157
নির্ভরযোগ্যতা 9.9 10.0
ধারাবাহিকতা 8.1 8.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 27.3% 40.9%
অস্থির টেস্ট 5 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 3.153 2.368
মোট খরচ $0.127 $0.164
ইনপুট মূল্য $0.100 / 1M $0.966 / 1M
আউটপুট মূল্য $0.200 / 1M $3.036 / 1M
মোট ইনপুট টোকেন 208,931 124,209
আউটপুট টোকেন 175,588 14,393
রিজনিং টোকেন 409,276 0
প্রতিক্রিয়া সময় (গড়) 111.61s 6.70s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 1190.11s 61.20s
প্রতিক্রিয়া সময় (মোট) 2455.39s 147.38s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 Laguna S 2.1

high
খরচ
$0.001
সময়
6.8s
টোকেন
1,389 tok

#157 GLM 5.1

none
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009
GLM 5.1 3.9 9.7 0.0% 0 4.96s 7,256 525 0

দ্রুত তুলনা

তুলনার জুটি বদলান