নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 4.8 (low) vs GLM 5.2 (medium)

GLM 5.2 (medium) average score-এ এগিয়ে: 7.8 vs 7.8. GLM 5.2 (medium)-এর benchmark খরচ কম: $0.276 vs $2.089. Claude Opus 4.8 (low) দ্রুত: 12.88s vs 23.28s, pass rates 80.3% vs 80.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-29

র‍্যাঙ্ক
#71
মোট আউটপুট টোকেন
52,237
প্রতিক্রিয়া সময় (গড়)
12.88s
মোট খরচ
$2.089
র‍্যাঙ্ক
#66
মোট আউটপুট টোকেন
61,761
প্রতিক্রিয়া সময় (গড়)
23.28s
মোট খরচ
$0.276
প্রস্তাবিত মডেল GLM 5.2 (medium)

It has the best score here (7.8), while costing about 7.6x less than Claude Opus 4.8 (low).

বিস্তারিত তুলনা

মেট্রিক Claude Opus 4.8 Claude Opus 4.8 low প্রকাশ: 2026-05-28 GLM 5.2 GLM 5.2 medium প্রকাশ: 2026-06-17
স্কোর 7.8 7.8
র‍্যাঙ্ক #71 #66
নির্ভরযোগ্যতা 10.0 9.5
ধারাবাহিকতা 8.9 8.0
প্রচেষ্টা 66/66 63/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 80.3% 80.3%
অস্থির টেস্ট 3 4
মোট রান 66 63
প্রতি ফলাফলে খরচ 13.054 2.159
মোট খরচ $2.089 $0.276
ইনপুট মূল্য $5.000 / 1M $1.190 / 1M
আউটপুট মূল্য $25.000 / 1M $3.740 / 1M
মোট ইনপুট টোকেন 156,522 37,199
আউটপুট টোকেন 43,056 12,261
রিজনিং টোকেন 9,181 49,500
প্রতিক্রিয়া সময় (গড়) 12.88s 23.28s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 127.97s 101.36s
প্রতিক্রিয়া সময় (মোট) 283.32s 488.94s
প্যারামিটার ~5T মোট (~500B সক্রিয়) 744B মোট (40B সক্রিয়)
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Claude Opus 4.8

low
খরচ
$0.031
সময়
14.1s
টোকেন
1,345 tok

#66 GLM 5.2

medium
খরচ
$0.041
সময়
195.8s
টোকেন
9,287 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 6.6 4.6 77.8% 2 7.58s 10,590 3,637 809
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

দ্রুত তুলনা

তুলনার জুটি বদলান

Claude Opus 4.8lowvsSeed-2.0-LitemediumClaude Opus 4.8lowvsQwen3.7 FlashhighClaude Opus 4.8lowvsQwen3.8 27BmediumClaude Opus 4.8lowvsGLM 5mediumQwen3.8 27BlowvsGLM 5.2mediumGPT-5.2 ChatnonevsGLM 5.2mediumClaude Opus 4.8lowvsGPT-5.6 TerramediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGemini 3.5 Flash LitemediumClaude Opus 4.8lowvsQwen3.6 PlusmediumQwen3.7 FlashhighvsGLM 5.2mediumClaude Opus 4.8lowvsDeepSeek V4 Prohigh