নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kwaipilot: KAT-Coder-Pro V2.5 vs Z.ai: GLM 5.2

KAT-Coder-Pro V2.5 average score-এ এগিয়ে: 6.7 vs 6.6. GLM 5.2-এর benchmark খরচ কম: $0.125 vs $0.476. GLM 5.2 দ্রুত: 9.34s vs 25.56s, pass rates 68.2% vs 59.1%.

প্রস্তাবিত মডেলGLM 5.2Its score stays close to the best score here (6.6 vs 6.7), while costing about 3.8x less than KAT-Coder-Pro V2.5.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none প্রকাশ: 2026-07-14 GLM 5.2 GLM 5.2 none প্রকাশ: 2026-06-17
স্কোর 6.7 6.6
র‍্যাঙ্ক #101 #105
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.4 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 68.2% 59.1%
অস্থির টেস্ট 7 2
মোট রান 66 64
প্রতি ফলাফলে খরচ 4.319 1.421
মোট খরচ $0.476 $0.125
ইনপুট মূল্য $0.740 / 1M $0.793 / 1M
আউটপুট মূল্য $2.960 / 1M $2.491 / 1M
মোট ইনপুট টোকেন 98,499 112,359
আউটপুট টোকেন 135,861 14,340
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 25.56s 9.34s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 335.41s 79.65s
প্রতিক্রিয়া সময় (মোট) 562.43s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#101 KAT-Coder-Pro V2.5

none
খরচ
$0.010
সময়
29.0s
টোকেন
3,439 tok

#105 GLM 5.2

none
অবৈধ SVG
খরচ
$0.033
সময়
87.7s
টোকেন
7,455 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

দ্রুত তুলনা

তুলনার জুটি বদলান