Advertise here
#273

GLM 5 Turbo

Z.ai প্রকাশ: 2026-03-15 পরীক্ষিত হয়েছে: 2026-06-04 13:05 z-ai/glm-5-turbo::none
744B মোট (40B সক্রিয়)MoEবন্ধ উৎস
(medium) (none)

সারাংশ

GLM 5 Turbo AI BENCHY-তে 5.1 স্কোর করে এবং #273 স্থানে আছে। এর reliability 10.0, pass rate 30.3%, মোট খরচ $0.047, এবং গড় response time 2.82s.

GLM 5 Turbo কে আলাদা করে যা: এটি ডোমেইন-নির্দিষ্ট-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #2; আর সমন্বিত এর দুর্বলতম ক্ষেত্র, rank #16.

আর্কাইভড মডেল: এই মডেল আর আপডেট করা হবে না এবং নতুন টেস্টে পরীক্ষা করা হবে না।

মডেলের তথ্য

গবেষণার তারিখ: 2026-08-12

প্রকাশিত
প্যারামিটার
744B মোট (40B সক্রিয়)
আর্কিটেকচার
MoE
উপলভ্যতা
বন্ধ উৎস
লাইসেন্স
-

ধারাবাহিকতা

8.9

মোট খরচ (বর্তমান মূল্য)

$0.047 ↑ +17.9%

পরীক্ষার সময়: $0.040

মোট আউটপুট টোকেন

1,815

মোট ইনপুট টোকেন

32,525

ইনপুট মূল্য

$1.200 / 1M

আউটপুট মূল্য

$4.000 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 15

প্রতি চেষ্টায় পাস রেট: 30.3%

অস্থির টেস্ট

2

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

2.82s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 8.21s

প্রতিক্রিয়া সময় (মোট): 59.29s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#273 GLM 5 Turbo

none
খরচ
$0.047
সময়
129.2s
টোকেন
11,775 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-06-04 13:05 পুনরায় পরীক্ষা 5.1 10.0 $0.047 বর্তমান রান
2026-06-04 13:05 পুনরায় পরীক্ষা 5.1 10.0 $0.047 তুলনা করুন
2026-06-04 13:05 নতুন টেস্ট যোগ হয়েছে 5.2 10.0 $0.047 তুলনা করুন
2026-05-21 23:41 স্যুইট পরিবর্তিত হয়েছে 5.3 10.0 $0.037 তুলনা করুন
2026-04-11 01:19 প্রথম নথিভুক্ত রান 5.5 প্রযোজ্য নয় $0.032 তুলনা করুন

রান তুলনা

রানবেঞ্চমার্ক কভারেজস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট ইনপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-06-04 13:05 · বর্তমান রান63/66 প্রচেষ্টা5.18.910.06/2121,81532,525$0.0472.82s
2026-05-21 23:41 · স্যুইট পরিবর্তিত হয়েছে60/60 প্রচেষ্টা5.39.310.06/2021,8090$0.0372.83s
পার্থক্য-0.2-0.40.000+6+32525+$0.011-6ms

বেঞ্চমার্ক কভারেজ আলাদা: 63/66 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি) বনাম 60/60 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি)। মোট মান ও পুনরাবৃত্তি-সংবেদনশীল মেট্রিক সরাসরি তুলনাযোগ্য নয়।

এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।

মূল্যের ইতিহাস

OpenRouter থেকে এই মডেলের ঐতিহাসিক মূল্য তথ্য।

তারিখ ইনপুট মূল্য আউটপুট মূল্য
2026-06-04 15:40 $1.200 / 1M $4.000 / 1M

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 3.0 10.0
কোডিং 3.9 7.8
সমন্বিত 1.5 5.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 5.3 10.0
Sadharon Buddhimotta 4.2 9.9
নির্দেশনা অনুসরণ 6.5 10.0
ধাঁধা সমাধান 5.5 7.4
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল