নেভিগেশন
AI BENCHY
Advertise here

তুলনা করা মডেল

Kimi K2.6 (medium) vs Kimi K2.5 (medium) vs GLM 5 (medium) vs Claude Opus 4.7 (medium) benchmark তুলনা: Claude Opus 4.7 (medium) স্কোর-এ 8.7 নিয়ে এগিয়ে। Kimi K2.5 (medium) নির্ভরযোগ্যতা-এ 10.0 নিয়ে এগিয়ে। GLM 5 (medium)-এর মোট খরচ সবচেয়ে কম, $0.307. Claude Opus 4.7 (medium) 7.61s-এ সবচেয়ে দ্রুত।

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#78
মোট আউটপুট টোকেন
391,540
প্রতিক্রিয়া সময় (গড়)
109.98s
মোট খরচ
$0.831
র‍্যাঙ্ক
#87
মোট আউটপুট টোকেন
227,367
প্রতিক্রিয়া সময় (গড়)
99.00s
মোট খরচ
$0.600
র‍্যাঙ্ক
#50
মোট আউটপুট টোকেন
124,566
প্রতিক্রিয়া সময় (গড়)
33.54s
মোট খরচ
$0.307
র‍্যাঙ্ক
#20
মোট আউটপুট টোকেন
29,990
প্রতিক্রিয়া সময় (গড়)
7.61s
মোট খরচ
$1.477
প্রস্তাবিত মডেল Claude Opus 4.7 (medium)

It has the best score here (8.7), while responding about 10.6x faster than এই তুলনার অন্য মডেলগুলো.

বিস্তারিত তুলনা

মেট্রিক Kimi K2.6 Kimi K2.6 medium প্রকাশ: 2026-04-20 Kimi K2.5 Kimi K2.5 medium প্রকাশ: 2026-01-27 GLM 5 GLM 5 medium প্রকাশ: 2026-02-12 Claude Opus 4.7 Claude Opus 4.7 medium প্রকাশ: 2026-04-16
স্কোর 7.2 7.0 7.7 8.7
র‍্যাঙ্ক #78 #87 #50 #20
নির্ভরযোগ্যতা 9.4 10.0 10.0 10.0
ধারাবাহিকতা 8.3 7.0 8.1 9.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.6% 65.2% 78.8% 83.3%
অস্থির টেস্ট 4 8 4 1
মোট রান 66 66 63 66
প্রতি ফলাফলে খরচ 9.821 4.789 1.668 8.201
মোট খরচ $0.831 $0.600 $0.307 $1.477
ইনপুট মূল্য $0.646 / 1M $0.571 / 1M $0.950 / 1M $5.000 / 1M
আউটপুট মূল্য $2.720 / 1M $2.850 / 1M $2.551 / 1M $25.000 / 1M
মোট ইনপুট টোকেন 68,902 118,448 35,224 145,252
আউটপুট টোকেন 111,680 62,124 21,570 24,948
রিজনিং টোকেন 279,860 165,243 102,996 5,042
প্রতিক্রিয়া সময় (গড়) 109.98s 99.00s 33.54s 7.61s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 876.20s 281.00s 99.85s 65.40s
প্রতিক্রিয়া সময় (মোট) 2309.56s 1485.04s 435.99s 159.91s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#78 MoonshotAI: Kimi K2.6

medium
খরচ
$0.013
সময়
103.4s
টোকেন
3,620 tok

#87 MoonshotAI: Kimi K2.5

medium
খরচ
$0.030
সময়
58.6s
টোকেন
8,683 tok

#50 GLM 5

medium
খরচ
$0.005
সময়
20.7s
টোকেন
2,068 tok

#20 Claude Opus 4.7

medium
খরচ
$0.059
সময়
26.8s
টোকেন
2,475 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114

দ্রুত তুলনা

তুলনার জুটি বদলান