নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Anthropic: Claude Sonnet 4.6 vs Z.ai: GLM 5.2

Claude Sonnet 4.6 average score-এ এগিয়ে: 7.3 vs 6.6. GLM 5.2-এর benchmark খরচ কম: $0.125 vs $0.661. Claude Sonnet 4.6 দ্রুত: 8.12s vs 9.34s, pass rates 57.6% vs 59.1%.

প্রস্তাবিত মডেলGLM 5.2Its score stays close to the best score here (6.6 vs 7.3), while costing about 5.3x less than Claude Sonnet 4.6.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Sonnet 4.6 Claude Sonnet 4.6 none প্রকাশ: 2026-02-17 GLM 5.2 GLM 5.2 none প্রকাশ: 2026-06-17
স্কোর 7.3 6.6
র‍্যাঙ্ক #71 #105
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.7 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 57.6% 59.1%
অস্থির টেস্ট 1 2
মোট রান 66 64
প্রতি ফলাফলে খরচ 5.502 1.421
মোট খরচ $0.661 $0.125
ইনপুট মূল্য $3.000 / 1M $0.793 / 1M
আউটপুট মূল্য $15.000 / 1M $2.491 / 1M
মোট ইনপুট টোকেন 123,264 112,359
আউটপুট টোকেন 19,362 14,340
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 8.12s 9.34s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 51.18s 79.65s
প্রতিক্রিয়া সময় (মোট) 121.78s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Claude Sonnet 4.6

none
খরচ
$0.038
সময়
27.3s
টোকেন
2,598 tok

#105 GLM 5.2

none
অবৈধ SVG
খরচ
$0.033
সময়
87.7s
টোকেন
7,455 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

দ্রুত তুলনা

তুলনার জুটি বদলান