নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 4.8 vs GLM 5.3 (high)

GLM 5.3 (high) average score-এ এগিয়ে: 7.3 vs 7.3. GLM 5.3 (high)-এর benchmark খরচ কম: $0.403 vs $1.166. Claude Opus 4.8 দ্রুত: 4.92s vs 27.82s, pass rates 63.6% vs 74.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-20

র‍্যাঙ্ক
#104
মোট আউটপুট টোকেন
16,797
প্রতিক্রিয়া সময় (গড়)
4.92s
মোট খরচ
$1.166
র‍্যাঙ্ক
#99
মোট আউটপুট টোকেন
63,667
প্রতিক্রিয়া সময় (গড়)
27.82s
মোট খরচ
$0.403
প্রস্তাবিত মডেল GLM 5.3 (high)

It has the best score here (7.3), while costing about 2.9x less than Claude Opus 4.8.

বিস্তারিত তুলনা

মেট্রিক Claude Opus 4.8 Claude Opus 4.8 none প্রকাশ: 2026-05-28 GLM 5.3 GLM 5.3 high প্রকাশ: 2026-08-20
স্কোর 7.3 7.3
র‍্যাঙ্ক #104 #99
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.2 7.5
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.6% 74.2%
অস্থির টেস্ট 2 7
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.969 3.099
মোট খরচ $1.166 $0.403
ইনপুট মূল্য $5.000 / 1M $1.400 / 1M
আউটপুট মূল্য $25.000 / 1M $4.400 / 1M
মোট ইনপুট টোকেন 149,203 87,601
আউটপুট টোকেন 16,797 6,006
রিজনিং টোকেন 0 57,661
প্রতিক্রিয়া সময় (গড়) 4.92s 27.82s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 35.03s 159.91s
প্রতিক্রিয়া সময় (মোট) 108.24s 612.06s
প্যারামিটার ~5T মোট (~500B সক্রিয়) 744B মোট (40B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 Claude Opus 4.8

none
খরচ
$0.053
সময়
22.0s
টোকেন
2,253 tok

#99 GLM 5.3

high
খরচ
$0.085
সময়
362.5s
টোকেন
19,310 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

দ্রুত তুলনা

তুলনার জুটি বদলান