নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

MoonshotAI: Kimi K2.6 vs Qwen: Qwen3.5-35B-A3B

Qwen3.5-35B-A3B average score-এ এগিয়ে: 6.1 vs 5.8. Qwen3.5-35B-A3B-এর benchmark খরচ কম: $0.106 vs $0.184. Qwen3.5-35B-A3B দ্রুত: 12.72s vs 19.58s, pass rates 34.9% vs 43.9%.

প্রস্তাবিত মডেলQwen3.5-35B-A3BIt has the best score here (6.1), while costing about 1.7x less than Kimi K2.6.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক Kimi K2.6 Kimi K2.6 none প্রকাশ: 2026-04-20 Qwen3.5-35B-A3B Qwen3.5-35B-A3B none প্রকাশ: 2026-02-24
স্কোর 5.8 6.1
র‍্যাঙ্ক #138 #127
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.3 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 34.9% 43.9%
অস্থির টেস্ট 2 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 3.199 1.578
মোট খরচ $0.184 $0.106
ইনপুট মূল্য $0.684 / 1M $0.140 / 1M
আউটপুট মূল্য $3.420 / 1M $1.000 / 1M
মোট ইনপুট টোকেন 116,970 134,521
আউটপুট টোকেন 30,253 86,614
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 19.58s 12.72s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 238.89s 209.15s
প্রতিক্রিয়া সময় (মোট) 430.85s 279.90s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#138 MoonshotAI: Kimi K2.6

none
খরচ
$0.020
সময়
127.4s
টোকেন
4,429 tok

#127 Qwen3.5-35B-A3B

none
খরচ
$0.005
সময়
28.4s
টোকেন
4,518 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0
Qwen3.5-35B-A3B 5.5 10.0 33.3% 0 1.39s 7,808 571 0

দ্রুত তুলনা

তুলনার জুটি বদলান