نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kwaipilot: KAT-Coder-Pro V2.5 vs Z.ai: GLM 5.2

KAT-Coder-Pro V2.5 average score میں آگے ہے: 6.7 vs 6.6. GLM 5.2 کی benchmark لاگت کم ہے: $0.125 vs $0.476. GLM 5.2 تیز ہے: 9.34s vs 25.56s، pass rates 68.2% vs 59.1%.

تجویز کردہ ماڈلGLM 5.2Its score stays close to the best score here (6.6 vs 6.7), while costing about 3.8x less than KAT-Coder-Pro V2.5.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-25

میٹرک KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none اجرا: 2026-07-14 GLM 5.2 GLM 5.2 none اجرا: 2026-06-17
اسکور 6.7 6.6
درجہ #101 #105
اعتماد پذیری 10.0 10.0
تسلسل 7.4 9.2
درست ٹیسٹس
فی کوشش کامیابی کی شرح 68.2% 59.1%
غیر مستحکم ٹیسٹ 7 2
کل رنز 66 64
فی نتیجہ لاگت 4.319 1.421
کل لاگت $0.476 $0.125
ان پٹ قیمت $0.740 / 1M $0.793 / 1M
آؤٹ پٹ قیمت $2.960 / 1M $2.491 / 1M
کل ان پٹ ٹوکنز 98,499 112,359
آؤٹ پٹ ٹوکنز 135,861 14,340
ریزننگ ٹوکنز 0 0
ردِعمل کا وقت (اوسط) 25.56s 9.34s
ردِعمل کا وقت (زیادہ سے زیادہ) 335.41s 79.65s
ردِعمل کا وقت (کل) 562.43s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#101 KAT-Coder-Pro V2.5

none
لاگت
$0.010
وقت
29.0s
ٹوکنز
3,439 tok

#105 GLM 5.2

none
غلط SVG
لاگت
$0.033
وقت
87.7s
ٹوکنز
7,455 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں