নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

ByteDance Seed: Seed-2.0-Lite vs Z.ai: GLM 5.2

average score প্রায় সমান: 7.9 vs 7.8. GLM 5.2 (medium)-এর benchmark খরচ কম: $0.184 vs $0.234. GLM 5.2 (medium) দ্রুত: 23.28s vs 48.53s, pass rates 74.2% vs 80.3%.

প্রস্তাবিত মডেলGLM 5.2 (medium)It has the best score here (7.8), while responding about 2.1x faster than Seed-2.0-Lite (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Seed-2.0-Lite Seed-2.0-Lite medium প্রকাশ: 2026-02-14 GLM 5.2 GLM 5.2 medium প্রকাশ: 2026-06-17
স্কোর 7.9 7.8
র‍্যাঙ্ক #42 #45
নির্ভরযোগ্যতা 10.0 9.5
ধারাবাহিকতা 8.6 8.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 74.2% 80.3%
অস্থির টেস্ট 4 4
মোট রান 66 63
প্রতি ফলাফলে খরচ 1.669 2.159
মোট খরচ $0.234 $0.184
ইনপুট মূল্য $0.250 / 1M $0.793 / 1M
আউটপুট মূল্য $2.000 / 1M $2.491 / 1M
মোট ইনপুট টোকেন 129,897 37,199
আউটপুট টোকেন 12,533 12,261
রিজনিং টোকেন 88,047 49,500
প্রতিক্রিয়া সময় (গড়) 48.53s 23.28s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 254.92s 101.36s
প্রতিক্রিয়া সময় (মোট) 1067.74s 488.94s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Seed-2.0-Lite

medium
খরচ
$0.005
সময়
86.7s
টোকেন
2,354 tok

#45 GLM 5.2

medium
খরচ
$0.041
সময়
195.8s
টোকেন
9,287 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

দ্রুত তুলনা

তুলনার জুটি বদলান