নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.3 Chat vs Xiaomi: MiMo-V2.5-Pro

GPT-5.3 Chat average score-এ এগিয়ে: 7.5 vs 6.9. MiMo-V2.5-Pro (medium)-এর benchmark খরচ কম: $0.187 vs $0.571. GPT-5.3 Chat দ্রুত: 6.88s vs 33.92s, pass rates 68.2% vs 66.7%.

প্রস্তাবিত মডেলGPT-5.3 ChatIt has the best score here (7.5), while responding about 4.9x faster than MiMo-V2.5-Pro (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক GPT-5.3 Chat GPT-5.3 Chat none প্রকাশ: 2026-03-03 MiMo-V2.5-Pro MiMo-V2.5-Pro medium প্রকাশ: 2026-04-22
স্কোর 7.5 6.9
র‍্যাঙ্ক #62 #92
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.2 8.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 68.2% 66.7%
অস্থির টেস্ট 5 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.387 3.218
মোট খরচ $0.571 $0.187
ইনপুট মূল্য $1.750 / 1M $0.435 / 1M
আউটপুট মূল্য $14.000 / 1M $0.870 / 1M
মোট ইনপুট টোকেন 78,990 139,883
আউটপুট টোকেন 30,854 15,521
রিজনিং টোকেন 0 130,992
প্রতিক্রিয়া সময় (গড়) 6.88s 33.92s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 18.33s 197.54s
প্রতিক্রিয়া সময় (মোট) 151.31s 746.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 GPT-5.3 Chat

none
খরচ
$0.008
সময়
8.1s
টোকেন
634 tok

#92 MiMo-V2.5-Pro

medium
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218

দ্রুত তুলনা

তুলনার জুটি বদলান