নেভিগেশন
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Z.ai: GLM 5.2

average score প্রায় সমান: 6.6 vs 6.6. GLM 5.2-এর benchmark খরচ কম: $0.151 vs $0.469. GLM 5.2 দ্রুত: 9.34s vs 148.73s, pass rates 53.0% vs 59.1%.

প্রস্তাবিত মডেলGLM 5.2It has the best score here (6.6), while costing about 3.1x less than LongCat 2.0 (high).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক LongCat 2.0 LongCat 2.0 high প্রকাশ: 2026-07-20 GLM 5.2 GLM 5.2 none প্রকাশ: 2026-06-17
স্কোর 6.6 6.6
র‍্যাঙ্ক #97 #96
নির্ভরযোগ্যতা 9.4 10.0
ধারাবাহিকতা 8.2 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.0% 59.1%
অস্থির টেস্ট 5 2
মোট রান 66 64
প্রতি ফলাফলে খরচ 5.202 1.421
মোট খরচ $0.469 $0.151
ইনপুট মূল্য $0.300 / 1M $0.960 / 1M
আউটপুট মূল্য $1.200 / 1M $3.014 / 1M
মোট ইনপুট টোকেন 93,357 112,359
আউটপুট টোকেন 30,466 14,340
রিজনিং টোকেন 336,325 0
প্রতিক্রিয়া সময় (গড়) 148.73s 9.34s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 941.66s 79.65s
প্রতিক্রিয়া সময় (মোট) 3272.00s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 LongCat 2.0

high
অবৈধ SVG
খরচ
$0.000
সময়
600.0s
টোকেন
0 tok

#96 GLM 5.2

none
অবৈধ SVG
খরচ
$0.033
সময়
87.7s
টোকেন
7,455 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
LongCat 2.0 7.6 7.2 77.8% 1 505.33s 6,913 244 192,377
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

দ্রুত তুলনা

তুলনার জুটি বদলান