নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Meituan: LongCat 2.0 vs Z.ai: GLM 5.2

LongCat 2.0 (low) average score-এ এগিয়ে: 6.7 vs 6.6. GLM 5.2-এর benchmark খরচ কম: $0.151 vs $0.391. GLM 5.2 দ্রুত: 9.34s vs 100.31s, pass rates 53.0% vs 59.1%.

প্রস্তাবিত মডেলGLM 5.2Its score stays close to the best score here (6.6 vs 6.7), while costing about 2.6x less than LongCat 2.0 (low).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক LongCat 2.0 LongCat 2.0 low প্রকাশ: 2026-07-20 GLM 5.2 GLM 5.2 none প্রকাশ: 2026-06-17
স্কোর 6.7 6.6
র‍্যাঙ্ক #91 #96
নির্ভরযোগ্যতা 9.6 10.0
ধারাবাহিকতা 8.9 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.0% 59.1%
অস্থির টেস্ট 3 2
মোট রান 66 64
প্রতি ফলাফলে খরচ 3.910 1.421
মোট খরচ $0.391 $0.151
ইনপুট মূল্য $0.300 / 1M $0.960 / 1M
আউটপুট মূল্য $1.200 / 1M $3.014 / 1M
মোট ইনপুট টোকেন 90,909 112,359
আউটপুট টোকেন 5,679 14,340
রিজনিং টোকেন 297,369 0
প্রতিক্রিয়া সময় (গড়) 100.31s 9.34s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 560.39s 79.65s
প্রতিক্রিয়া সময় (মোট) 2206.82s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 LongCat 2.0

low
খরচ
$0.024
সময়
428.0s
টোকেন
19,557 tok

#96 GLM 5.2

none
অবৈধ SVG
খরচ
$0.033
সময়
87.7s
টোকেন
7,455 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

দ্রুত তুলনা

তুলনার জুটি বদলান