Advertise here
#83

GLM 5 Turbo

Z.ai প্রকাশ: 2026-03-15 পরীক্ষিত হয়েছে: 2026-04-11 01:19 z-ai/glm-5-turbo::none
744B মোট (40B সক্রিয়)MoEবন্ধ উৎস
(medium) (none)

সারাংশ

GLM 5 Turbo AI BENCHY-তে 5.5 স্কোর করে এবং #83 স্থানে আছে। এর reliability প্রযোজ্য নয়, pass rate 37.0%, মোট খরচ $0.032, এবং গড় response time 2.94s.

GLM 5 Turbo কে আলাদা করে যা: এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম। একই ধরনের মডেলের তুলনায় এটি লক্ষণীয়ভাবে দ্রুত।

আর্কাইভড মডেল: এই মডেল আর আপডেট করা হবে না এবং নতুন টেস্টে পরীক্ষা করা হবে না।

মডেলের তথ্য

গবেষণার তারিখ: 2026-08-12

প্রকাশিত
প্যারামিটার
744B মোট (40B সক্রিয়)
আর্কিটেকচার
MoE
উপলভ্যতা
বন্ধ উৎস
লাইসেন্স
-

ধারাবাহিকতা

9.2

নির্ভরযোগ্যতা

প্রযোজ্য নয়

মোট আউটপুট টোকেন

1,775

মোট ইনপুট টোকেন

0

ইনপুট মূল্য

$1.200 / 1M

আউটপুট মূল্য

$4.000 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 12

প্রতি চেষ্টায় পাস রেট: 37.0%

অস্থির টেস্ট

2

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

2.94s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 8.21s

প্রতিক্রিয়া সময় (মোট): 52.98s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#83 GLM 5 Turbo

none
খরচ
$0.047
সময়
129.2s
টোকেন
11,775 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-06-04 13:05 পুনরায় পরীক্ষা 5.1 10.0 $0.047 তুলনা করুন
2026-06-04 13:05 পুনরায় পরীক্ষা 5.1 10.0 $0.047 তুলনা করুন
2026-06-04 13:05 নতুন টেস্ট যোগ হয়েছে 5.2 10.0 $0.047 তুলনা করুন
2026-05-21 23:41 স্যুইট পরিবর্তিত হয়েছে 5.3 10.0 $0.037 তুলনা করুন
2026-04-11 01:19 প্রথম নথিভুক্ত রান 5.5 প্রযোজ্য নয় $0.032 বর্তমান রান

রান তুলনা

রানবেঞ্চমার্ক কভারেজস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট ইনপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-04-11 01:19 · প্রথম নথিভুক্ত রান54/54 প্রচেষ্টা5.59.2প্রযোজ্য নয়6/1821,7750$0.0322.94s
2026-06-04 13:05 · পুনরায় পরীক্ষা63/63 প্রচেষ্টা5.18.910.06/2121,81532,525$0.0472.82s
পার্থক্য+0.4+0.300-40-32525-$0.016+120ms

বেঞ্চমার্ক কভারেজ আলাদা: 54/54 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি) বনাম 63/63 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি)। মোট মান ও পুনরাবৃত্তি-সংবেদনশীল মেট্রিক সরাসরি তুলনাযোগ্য নয়।

এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 3.0 10.0
কোডিং 5.3 3.4
সমন্বিত 3.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 5.3 10.0
Sadharon Buddhimotta 4.2 9.9
নির্দেশনা অনুসরণ 6.5 10.0
ধাঁধা সমাধান 5.5 7.4
টুল কলিং 10.0 10.0

তুলনা করা মডেল