নেভিগেশন
AI BENCHY
Advertise here

Seed-2.0-Code (low) vs GLM 5.2 (medium)

GLM 5.2 (medium) average score-এ এগিয়ে: 7.8 vs 7.7. GLM 5.2 (medium)-এর benchmark খরচ কম: $0.214 vs $0.681. GLM 5.2 (medium) দ্রুত: 23.28s vs 65.89s, pass rates 80.3% vs 80.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-12

র‍্যাঙ্ক
#66
মোট আউটপুট টোকেন
212,558
প্রতিক্রিয়া সময় (গড়)
65.89s
মোট খরচ
$0.681
র‍্যাঙ্ক
#61
মোট আউটপুট টোকেন
61,761
প্রতিক্রিয়া সময় (গড়)
23.28s
মোট খরচ
$0.214
প্রস্তাবিত মডেল GLM 5.2 (medium)

It has the best score here (7.8), while costing about 3.2x less than Seed-2.0-Code (low).

বিস্তারিত তুলনা

মেট্রিক Seed-2.0-Code Seed-2.0-Code low প্রকাশ: 2026-08-12 GLM 5.2 GLM 5.2 medium প্রকাশ: 2026-06-17
স্কোর 7.7 7.8
র‍্যাঙ্ক #66 #61
নির্ভরযোগ্যতা 5.7 9.5
ধারাবাহিকতা 7.5 8.0
প্রচেষ্টা 66/66 63/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 80.3% 80.3%
অস্থির টেস্ট 7 4
মোট রান 66 63
প্রতি ফলাফলে খরচ 5.235 2.159
মোট খরচ $0.681 $0.214
ইনপুট মূল্য $0.500 / 1M $0.500 / 1M
আউটপুট মূল্য $3.000 / 1M $3.150 / 1M
মোট ইনপুট টোকেন 85,648 37,199
আউটপুট টোকেন 8,142 12,261
রিজনিং টোকেন 204,416 49,500
প্রতিক্রিয়া সময় (গড়) 65.89s 23.28s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 485.92s 101.36s
প্রতিক্রিয়া সময় (মোট) 1449.53s 488.94s
প্যারামিটার ~200B মোট (~20B সক্রিয়) 744B মোট (40B সক্রিয়)
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 Seed-2.0-Code

low
Provider returned error
খরচ
$0.000
সময়
0.3s
টোকেন
0 tok

#61 GLM 5.2

medium
খরচ
$0.041
সময়
195.8s
টোকেন
9,287 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Code 7.0 5.0 77.8% 2 109.70s 7,948 455 55,759
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

দ্রুত তুলনা

তুলনার জুটি বদলান