নেভিগেশন
AI BENCHY
Advertise here

Seed-2.0-Code (low) vs GLM 5 (medium)

average score প্রায় সমান: 7.7 vs 7.7. GLM 5 (medium)-এর benchmark খরচ কম: $0.307 vs $0.681. GLM 5 (medium) দ্রুত: 33.54s vs 65.89s, pass rates 80.3% vs 78.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-12

র‍্যাঙ্ক
#66
মোট আউটপুট টোকেন
212,558
প্রতিক্রিয়া সময় (গড়)
65.89s
মোট খরচ
$0.681
র‍্যাঙ্ক
#67
মোট আউটপুট টোকেন
124,566
প্রতিক্রিয়া সময় (গড়)
33.54s
মোট খরচ
$0.307
প্রস্তাবিত মডেল GLM 5 (medium)

It has the best score here (7.7), while costing about 2.2x less than Seed-2.0-Code (low).

বিস্তারিত তুলনা

মেট্রিক Seed-2.0-Code Seed-2.0-Code low প্রকাশ: 2026-08-12 GLM 5 GLM 5 medium প্রকাশ: 2026-02-12
স্কোর 7.7 7.7
র‍্যাঙ্ক #66 #67
নির্ভরযোগ্যতা 5.7 10.0
ধারাবাহিকতা 7.5 8.1
প্রচেষ্টা 66/66 63/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 80.3% 78.8%
অস্থির টেস্ট 7 4
মোট রান 66 63
প্রতি ফলাফলে খরচ 5.235 1.668
মোট খরচ $0.681 $0.307
ইনপুট মূল্য $0.500 / 1M $0.950 / 1M
আউটপুট মূল্য $3.000 / 1M $2.551 / 1M
মোট ইনপুট টোকেন 85,648 35,224
আউটপুট টোকেন 8,142 21,570
রিজনিং টোকেন 204,416 102,996
প্রতিক্রিয়া সময় (গড়) 65.89s 33.54s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 485.92s 99.85s
প্রতিক্রিয়া সময় (মোট) 1449.53s 435.99s
প্যারামিটার ~200B মোট (~20B সক্রিয়) 744B মোট (40B সক্রিয়)
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 Seed-2.0-Code

low
Provider returned error
খরচ
$0.000
সময়
0.3s
টোকেন
0 tok

#67 GLM 5

medium
খরচ
$0.005
সময়
20.7s
টোকেন
2,068 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Code 7.0 5.0 77.8% 2 109.70s 7,948 455 55,759
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

দ্রুত তুলনা

তুলনার জুটি বদলান