নেভিগেশন
AI BENCHY
Advertise here

তুলনা করা মডেল

GLM 5 (medium) vs GLM 5.1 (medium) vs Kimi K2.5 (medium) vs Qwen3.6 Plus Preview (medium) benchmark তুলনা: GLM 5 (medium) স্কোর-এ 7.7 নিয়ে এগিয়ে। GLM 5 (medium) নির্ভরযোগ্যতা-এ 10.0 নিয়ে এগিয়ে। Qwen3.6 Plus Preview (medium)-এর মোট খরচ সবচেয়ে কম, $0.000. Qwen3.6 Plus Preview (medium) 15.25s-এ সবচেয়ে দ্রুত।

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#49
মোট আউটপুট টোকেন
124,566
প্রতিক্রিয়া সময় (গড়)
33.54s
মোট খরচ
$0.307
র‍্যাঙ্ক
#82
মোট আউটপুট টোকেন
152,552
প্রতিক্রিয়া সময় (গড়)
46.77s
মোট খরচ
$0.535
র‍্যাঙ্ক
#85
মোট আউটপুট টোকেন
227,367
প্রতিক্রিয়া সময় (গড়)
99.00s
মোট খরচ
$0.600
র‍্যাঙ্ক
#190
মোট আউটপুট টোকেন
63,350
প্রতিক্রিয়া সময় (গড়)
15.25s
মোট খরচ
$0.000
প্রস্তাবিত মডেল GLM 5 (medium)

It has the best score here (7.7), while costing about 1.8x less than এই তুলনার অন্য মডেলগুলো.

বিস্তারিত তুলনা

মেট্রিক GLM 5 GLM 5 medium প্রকাশ: 2026-02-12 GLM 5.1 GLM 5.1 medium প্রকাশ: 2026-04-07 Kimi K2.5 Kimi K2.5 medium প্রকাশ: 2026-01-27 Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium প্রকাশ: 2026-04-20 বিনামূল্যে উপলভ্য
স্কোর 7.7 7.1 7.0 4.9
র‍্যাঙ্ক #49 #82 #85 #190
নির্ভরযোগ্যতা 10.0 8.3 10.0 প্রযোজ্য নয়
ধারাবাহিকতা 8.1 8.4 7.0 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 78.8% 69.7% 65.2% 40.9%
অস্থির টেস্ট 4 4 8 0
মোট রান 63 66 66 57
প্রতি ফলাফলে খরচ 1.668 4.202 4.789 0.000
মোট খরচ $0.307 $0.535 $0.600 $0.000
ইনপুট মূল্য $0.950 / 1M $0.966 / 1M $0.571 / 1M $0.000 / 1M
আউটপুট মূল্য $2.551 / 1M $3.036 / 1M $2.850 / 1M $0.000 / 1M
মোট ইনপুট টোকেন 35,224 82,623 118,448 32,639
আউটপুট টোকেন 21,570 16,089 62,124 1,153
রিজনিং টোকেন 102,996 136,463 165,243 62,197
প্রতিক্রিয়া সময় (গড়) 33.54s 46.77s 99.00s 15.25s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 99.85s 308.75s 281.00s 43.55s
প্রতিক্রিয়া সময় (মোট) 435.99s 982.16s 1485.04s 182.96s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#49 GLM 5

medium
খরচ
$0.005
সময়
20.7s
টোকেন
2,068 tok

#82 GLM 5.1

medium
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

#85 MoonshotAI: Kimi K2.5

medium
খরচ
$0.030
সময়
58.6s
টোকেন
8,683 tok

#190 Qwen3.6 Plus Preview

medium
এই মডেলের জন্য এখনও কোনো শোকেস ফলাফল তৈরি হয়নি।
খরচ
$0.000
সময়
-
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Qwen3.6 Plus Preview 9.8 3.3 0.0% 0 0ms 0 0 0

দ্রুত তুলনা

তুলনার জুটি বদলান