Advertise here
#349

GLM 4.7 Flash

Z.ai প্রকাশ: 2026-01-19 পরীক্ষিত হয়েছে: 2026-10-01 00:17 z-ai/glm-4.7-flash::medium
30B মোট (3B সক্রিয়)MoEউন্মুক্ত উৎস
(medium) (none)

সারাংশ

GLM 4.7 Flash AI BENCHY-তে 4.2 স্কোর করে এবং #349 স্থানে আছে। এর reliability 9.4, pass rate 30.4%, মোট খরচ $0.193, এবং গড় response time 150.90s.

GLM 4.7 Flash কে আলাদা করে যা: এটি অস্বাভাবিকভাবে বেশি reasoning tokens ব্যবহার করে, যা ধীর বা বেশি খরচের runs ব্যাখ্যা করতে পারে।

মডেলের তথ্য

গবেষণার তারিখ: 2026-08-12

প্রকাশিত
প্যারামিটার
30B মোট (3B সক্রিয়)
আর্কিটেকচার
MoE
উপলভ্যতা
উন্মুক্ত উৎস
লাইসেন্স
MIT

ধারাবাহিকতা

7.1

মোট আউটপুট টোকেন

464,375

মোট ইনপুট টোকেন

228,711

ইনপুট মূল্য

$0.061 / 1M

আউটপুট মূল্য

$0.400 / 1M

ক্যাশ পড়ার মূল্য

প্রযোজ্য নয়

ক্যাশ লেখার মূল্য

প্রযোজ্য নয়

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

সঠিক টেস্ট

ভুল টেস্ট: 19

প্রতি চেষ্টায় পাস রেট: 30.4%

অস্থির টেস্ট

8

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

150.90s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 1539.97s

প্রতিক্রিয়া সময় (মোট): 2414.33s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#349 GLM 4.7 Flash

medium
No output was saved. The original provider response or failure reason is unavailable.
খরচ
$0.000
সময়
186.2s
টোকেন
12,112 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-10-01 00:17 পুনরায় পরীক্ষা 4.2 9.4 $0.193 বর্তমান রান
2026-07-16 22:32 নতুন টেস্ট যোগ হয়েছে 4.3 7.8 $0.166 তুলনা করুন
2026-06-04 13:29 নতুন টেস্ট যোগ হয়েছে 4.4 6.7 $0.054 তুলনা করুন
2026-05-21 23:50 স্যুইট পরিবর্তিত হয়েছে 4.5 8.3 $0.054 তুলনা করুন
2026-04-11 01:19 প্রথম নথিভুক্ত রান 4.6 প্রযোজ্য নয় $0.046 তুলনা করুন

এই রানটি ভিন্ন একটি বেঞ্চমার্ক স্যুইট ব্যবহার করেছে। ঐতিহাসিক পরিবর্তন পড়ার সময় স্যুইট পরিবর্তনও মাথায় রাখুন।

রান তুলনা

রানবেঞ্চমার্ক কভারেজস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট ইনপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-10-01 00:17 · বর্তমান রান69/69 প্রচেষ্টা4.27.19.44/238464,375228,711$0.193150.90s
2026-04-11 01:19 · প্রথম নথিভুক্ত রান54/54 প্রচেষ্টা4.66.3প্রযোজ্য নয়4/188112,0890$0.04632.33s
পার্থক্য—-0.4+0.800+352286+228711+$0.148+118564ms

বেঞ্চমার্ক কভারেজ আলাদা: 69/69 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি) বনাম 54/54 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি)। মোট মান ও পুনরাবৃত্তি-সংবেদনশীল মেট্রিক সরাসরি তুলনাযোগ্য নয়।

এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।

মূল্যের ইতিহাস

OpenRouter থেকে এই মডেলের ঐতিহাসিক মূল্য তথ্য।

তারিখ ইনপুট মূল্য আউটপুট মূল্য ক্যাশ পড়ার মূল্য ক্যাশ লেখার মূল্য
2026-08-14 12:51 $0.060 / 1M $0.400 / 1M প্রযোজ্য নয় প্রযোজ্য নয়
2026-09-08 21:53 $0.061 / 1M $0.400 / 1M প্রযোজ্য নয় প্রযোজ্য নয়

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
স্বায়ত্তশাসিত এজেন্টের কাজ 3.9 9.6
অ্যান্টি-এআই কৌশল 4.7 5.9
কোডিং 3.2 7.4
সমন্বিত 2.9 6.0
ডেটা পার্সিং ও নিষ্কাশন 6.3 10.0
ডোমেইন-নির্দিষ্ট 3.5 4.4
Sadharon Buddhimotta 3.6 9.7
নির্দেশনা অনুসরণ 6.2 5.8
ধাঁধা সমাধান 2.9 7.2
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল