নেভিগেশন
AI BENCHY
Advertise here

Kimi K2.5 (medium) vs Qwen3.5-122B-A10B (medium)

Qwen3.5-122B-A10B (medium) average score-এ এগিয়ে: 7.1 vs 7.0. Kimi K2.5 (medium)-এর benchmark খরচ কম: $0.600 vs $1.046. Qwen3.5-122B-A10B (medium) দ্রুত: 64.16s vs 99.00s, pass rates 65.2% vs 71.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#85
মোট আউটপুট টোকেন
227,367
প্রতিক্রিয়া সময় (গড়)
99.00s
মোট খরচ
$0.600
র‍্যাঙ্ক
#80
মোট আউটপুট টোকেন
487,218
প্রতিক্রিয়া সময় (গড়)
64.16s
মোট খরচ
$1.046
প্রস্তাবিত মডেল Qwen3.5-122B-A10B (medium)

It has the best score here (7.1), while responding about 1.5x faster than Kimi K2.5 (medium).

বিস্তারিত তুলনা

মেট্রিক Kimi K2.5 Kimi K2.5 medium প্রকাশ: 2026-01-27 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium প্রকাশ: 2026-02-24
স্কোর 7.0 7.1
র‍্যাঙ্ক #85 #80
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.0 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.2% 71.2%
অস্থির টেস্ট 8 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.789 8.509
মোট খরচ $0.600 $1.046
ইনপুট মূল্য $0.571 / 1M $0.260 / 1M
আউটপুট মূল্য $2.850 / 1M $2.080 / 1M
মোট ইনপুট টোকেন 118,448 124,771
আউটপুট টোকেন 62,124 44,077
রিজনিং টোকেন 165,243 443,141
প্রতিক্রিয়া সময় (গড়) 99.00s 64.16s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 281.00s 519.30s
প্রতিক্রিয়া সময় (মোট) 1485.04s 1411.60s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#85 MoonshotAI: Kimi K2.5

medium
খরচ
$0.030
সময়
58.6s
টোকেন
8,683 tok

#80 Qwen3.5-122B-A10B

medium
খরচ
$0.019
সময়
48.7s
টোকেন
6,034 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

দ্রুত তুলনা

তুলনার জুটি বদলান