নেভিগেশন
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Xiaomi: MiMo-V2.5

MiMo-V2.5 (medium) average score-এ এগিয়ে: 6.5 vs 6.3. LongCat 2.0-এর benchmark খরচ কম: $0.044 vs $0.082. LongCat 2.0 দ্রুত: 5.18s vs 32.20s, pass rates 36.4% vs 69.7%.

প্রস্তাবিত মডেলLongCat 2.0Its score stays close to the best score here (6.3 vs 6.5), while costing about 1.9x less than MiMo-V2.5 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-21

মেট্রিক LongCat 2.0 LongCat 2.0 none প্রকাশ: 2026-07-20 MiMo-V2.5 MiMo-V2.5 medium প্রকাশ: 2026-04-22
স্কোর 6.3 6.5
র‍্যাঙ্ক #117 #107
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.3 7.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 36.4% 69.7%
অস্থির টেস্ট 2 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.627 3.124
মোট খরচ $0.044 $0.082
ইনপুট মূল্য $0.300 / 1M $0.140 / 1M
আউটপুট মূল্য $1.200 / 1M $0.280 / 1M
মোট ইনপুট টোকেন 108,743 105,447
আউটপুট টোকেন 9,372 7,120
রিজনিং টোকেন 0 230,682
প্রতিক্রিয়া সময় (গড়) 5.18s 32.20s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 48.38s 162.44s
প্রতিক্রিয়া সময় (মোট) 113.95s 708.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#117 LongCat 2.0

none
খরচ
$0.027
সময়
411.7s
টোকেন
22,283 tok

#107 MiMo-V2.5

medium
খরচ
$0.002
সময়
54.8s
টোকেন
5,247 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

দ্রুত তুলনা

তুলনার জুটি বদলান