Advertise here
#137

GLM 5V Turbo

Z.ai প্রকাশ: 2026-04-01 পরীক্ষিত হয়েছে: 2026-06-04 13:05 z-ai/glm-5v-turbo::none
~106B মোট (~12B সক্রিয়)MoEবন্ধ উৎসআনুমানিক
(medium) (none)

সারাংশ

GLM 5V Turbo AI BENCHY-তে 5.6 স্কোর করে এবং #137 স্থানে আছে। এর reliability 10.0, pass rate 36.4%, মোট খরচ $0.052, এবং গড় response time 2.99s.

GLM 5V Turbo কে আলাদা করে যা: এটি ডোমেইন-নির্দিষ্ট-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #4; আর সমন্বিত এর দুর্বলতম ক্ষেত্র, rank #18. এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম। একই ধরনের মডেলের তুলনায় এটি লক্ষণীয়ভাবে দ্রুত।

আর্কাইভড মডেল: এই মডেল আর আপডেট করা হবে না এবং নতুন টেস্টে পরীক্ষা করা হবে না।

মডেলের তথ্য

গবেষণার তারিখ: 2026-08-12

আনুমানিক
প্যারামিটার
~106B মোট (~12B সক্রিয়)
আর্কিটেকচার
MoE
উপলভ্যতা
বন্ধ উৎস
লাইসেন্স
-

সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।

ধারাবাহিকতা

9.5

মোট আউটপুট টোকেন

1,766

মোট ইনপুট টোকেন

37,100

ইনপুট মূল্য

$1.200 / 1M

আউটপুট মূল্য

$4.000 / 1M

ক্যাশ পড়ার মূল্য

প্রযোজ্য নয়

ক্যাশ লেখার মূল্য

প্রযোজ্য নয়

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

সঠিক টেস্ট

ভুল টেস্ট: 13

প্রতি চেষ্টায় পাস রেট: 36.4%

অস্থির টেস্ট

0

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

2.99s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 6.51s

প্রতিক্রিয়া সময় (মোট): 62.74s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#137 GLM 5V Turbo

none
খরচ
$0.042
সময়
177.3s
টোকেন
10,434 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-06-04 13:05 পুনরায় পরীক্ষা 5.6 10.0 $0.052 তুলনা করুন
2026-06-04 13:05 পুনরায় পরীক্ষা 5.6 10.0 $0.052 বর্তমান রান
2026-06-04 13:05 নতুন টেস্ট যোগ হয়েছে 5.8 10.0 $0.052 তুলনা করুন
2026-05-21 23:41 স্যুইট পরিবর্তিত হয়েছে 5.9 10.0 $0.049 তুলনা করুন
2026-04-11 01:19 প্রথম নথিভুক্ত রান 6.2 প্রযোজ্য নয় $0.044 তুলনা করুন

রান তুলনা

রানবেঞ্চমার্ক কভারেজস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট ইনপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-06-04 13:05 · পুনরায় পরীক্ষা63/63 প্রচেষ্টা5.69.510.08/2101,76637,100$0.0522.99s
2026-04-11 01:19 · প্রথম নথিভুক্ত রান54/54 প্রচেষ্টা6.210.0প্রযোজ্য নয়8/1801,7240$0.0443.10s
পার্থক্য—-0.6-0.500+42+37100+$0.009-116ms

বেঞ্চমার্ক কভারেজ আলাদা: 63/63 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি) বনাম 54/54 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি)। মোট মান ও পুনরাবৃত্তি-সংবেদনশীল মেট্রিক সরাসরি তুলনাযোগ্য নয়।

এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।

মূল্যের ইতিহাস

OpenRouter থেকে এই মডেলের ঐতিহাসিক মূল্য তথ্য।

তারিখ ইনপুট মূল্য আউটপুট মূল্য ক্যাশ পড়ার মূল্য ক্যাশ লেখার মূল্য
2026-06-04 15:40 $1.200 / 1M $4.000 / 1M প্রযোজ্য নয় প্রযোজ্য নয়

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 4.8 10.0
কোডিং 5.5 10.0
সমন্বিত 1.5 5.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 5.3 10.0
Sadharon Buddhimotta 4.6 10.0
নির্দেশনা অনুসরণ 6.5 10.0
ধাঁধা সমাধান 5.3 10.0
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল