নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen: Qwen3.6 27B vs Xiaomi: MiMo-V2.5

average score প্রায় সমান: 6.5 vs 6.5. MiMo-V2.5 (medium)-এর benchmark খরচ কম: $0.082 vs $0.779. MiMo-V2.5 (medium) দ্রুত: 32.20s vs 106.32s, pass rates 59.1% vs 69.7%.

প্রস্তাবিত মডেলMiMo-V2.5 (medium)It has the best score here (6.5), while costing about 9.6x less than Qwen3.6 27B (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-21

মেট্রিক Qwen3.6 27B Qwen3.6 27B medium প্রকাশ: 2026-04-20 MiMo-V2.5 MiMo-V2.5 medium প্রকাশ: 2026-04-22
স্কোর 6.5 6.5
র‍্যাঙ্ক #105 #107
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.0 7.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 59.1% 69.7%
অস্থির টেস্ট 6 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 7.319 3.124
মোট খরচ $0.779 $0.082
ইনপুট মূল্য $0.450 / 1M $0.140 / 1M
আউটপুট মূল্য $2.700 / 1M $0.280 / 1M
মোট ইনপুট টোকেন 106,167 105,447
আউটপুট টোকেন 32,889 7,120
রিজনিং টোকেন 241,303 230,682
প্রতিক্রিয়া সময় (গড়) 106.32s 32.20s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 1085.11s 162.44s
প্রতিক্রিয়া সময় (মোট) 2339.12s 708.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#105 Qwen3.6 27B

medium
খরচ
$0.009
সময়
39.6s
টোকেন
3,090 tok

#107 MiMo-V2.5

medium
খরচ
$0.002
সময়
54.8s
টোকেন
5,247 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 27B 7.7 10.0 66.7% 0 142.99s 5,051 7,968 43,367
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

দ্রুত তুলনা

তুলনার জুটি বদলান