নেভিগেশন
AI BENCHY
Advertise here

OpenAI: GPT-5.6 Luna vs Xiaomi: MiMo-V2.5-Pro

MiMo-V2.5-Pro average score-এ এগিয়ে: 5.5 vs 5.4. MiMo-V2.5-Pro-এর benchmark খরচ কম: $0.068 vs $0.142. GPT-5.6 Luna দ্রুত: 1.50s vs 4.12s, pass rates 34.9% vs 37.9%.

প্রস্তাবিত মডেলMiMo-V2.5-ProIt has the best score here (5.5), while costing about 2.1x less than GPT-5.6 Luna.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক GPT-5.6 Luna GPT-5.6 Luna none প্রকাশ: 2026-07-09 MiMo-V2.5-Pro MiMo-V2.5-Pro none প্রকাশ: 2026-04-22
স্কোর 5.4 5.5
র‍্যাঙ্ক #166 #160
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.8 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 34.9% 37.9%
অস্থির টেস্ট 3 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.360 1.509
মোট খরচ $0.142 $0.068
ইনপুট মূল্য $1.000 / 1M $0.435 / 1M
আউটপুট মূল্য $6.000 / 1M $0.870 / 1M
মোট ইনপুট টোকেন 101,323 124,799
আউটপুট টোকেন 6,709 15,362
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 1.50s 4.12s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 10.57s 53.13s
প্রতিক্রিয়া সময় (মোট) 32.91s 90.55s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 GPT-5.6 Luna

none
খরচ
$0.016
সময়
15.8s
টোকেন
2,685 tok

#160 MiMo-V2.5-Pro

none
খরচ
$0.004
সময়
46.4s
টোকেন
4,025 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0

দ্রুত তুলনা

তুলনার জুটি বদলান