নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Poolside: Laguna S 2.1 vs Z.ai: GLM 5

GLM 5 average score-এ এগিয়ে: 5.7 vs 5.4. GLM 5-এর benchmark খরচ কম: $0.041 vs $0.059. GLM 5 দ্রুত: 4.03s vs 58.43s, pass rates 25.8% vs 42.4%.

প্রস্তাবিত মডেলGLM 5It has the best score here (5.7), while responding about 14.5x faster than Laguna S 2.1 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-24

মেট্রিক Laguna S 2.1 Laguna S 2.1 medium প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য GLM 5 GLM 5 none প্রকাশ: 2026-02-12
স্কোর 5.4 5.7
র‍্যাঙ্ক #166 #148
নির্ভরযোগ্যতা 9.8 10.0
ধারাবাহিকতা 8.4 9.3
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 25.8% 42.4%
অস্থির টেস্ট 4 1
মোট রান 66 63
প্রতি ফলাফলে খরচ 1.451 0.263
মোট খরচ $0.059 $0.041
ইনপুট মূল্য $0.100 / 1M $0.950 / 1M
আউটপুট মূল্য $0.200 / 1M $2.551 / 1M
মোট ইনপুট টোকেন 86,641 37,135
আউটপুট টোকেন 97,298 1,989
রিজনিং টোকেন 242,297 0
প্রতিক্রিয়া সময় (গড়) 58.43s 4.03s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 560.31s 11.07s
প্রতিক্রিয়া সময় (মোট) 1285.48s 56.37s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 Laguna S 2.1

medium
খরচ
$0.001
সময়
4.0s
টোকেন
867 tok

#148 GLM 5

none
খরচ
$0.007
সময়
32.1s
টোকেন
2,023 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
GLM 5 4.0 7.8 11.1% 1 5.12s 7,256 428 0

দ্রুত তুলনা

তুলনার জুটি বদলান