নেভিগেশন
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Xiaomi: MiMo-V2.5

LongCat 2.0 (low) average score-এ এগিয়ে: 6.7 vs 6.5. MiMo-V2.5 (medium)-এর benchmark খরচ কম: $0.082 vs $0.391. MiMo-V2.5 (medium) দ্রুত: 32.20s vs 100.31s, pass rates 53.0% vs 69.7%.

প্রস্তাবিত মডেলMiMo-V2.5 (medium)Its score stays close to the best score here (6.5 vs 6.7), while costing about 4.8x less than LongCat 2.0 (low).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-21

মেট্রিক LongCat 2.0 LongCat 2.0 low প্রকাশ: 2026-07-20 MiMo-V2.5 MiMo-V2.5 medium প্রকাশ: 2026-04-22
স্কোর 6.7 6.5
র‍্যাঙ্ক #96 #107
নির্ভরযোগ্যতা 9.6 10.0
ধারাবাহিকতা 8.9 7.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.0% 69.7%
অস্থির টেস্ট 3 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 3.910 3.124
মোট খরচ $0.391 $0.082
ইনপুট মূল্য $0.300 / 1M $0.140 / 1M
আউটপুট মূল্য $1.200 / 1M $0.280 / 1M
মোট ইনপুট টোকেন 90,909 105,447
আউটপুট টোকেন 5,679 7,120
রিজনিং টোকেন 297,369 230,682
প্রতিক্রিয়া সময় (গড়) 100.31s 32.20s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 560.39s 162.44s
প্রতিক্রিয়া সময় (মোট) 2206.82s 708.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 LongCat 2.0

low
খরচ
$0.024
সময়
428.0s
টোকেন
19,557 tok

#107 MiMo-V2.5

medium
খরচ
$0.002
সময়
54.8s
টোকেন
5,247 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

দ্রুত তুলনা

তুলনার জুটি বদলান