নেভিগেশন
AI BENCHY
Advertise here

Mistral Small 4 (medium) vs GPT-4o-mini

Mistral Small 4 (medium) average score-এ এগিয়ে: 5.1 vs 5.0. GPT-4o-mini-এর benchmark খরচ কম: $0.010 vs $0.096. GPT-4o-mini দ্রুত: 1.99s vs 10.77s, pass rates 42.4% vs 22.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-01

র‍্যাঙ্ক
#195
মোট আউটপুট টোকেন
131,824
প্রতিক্রিয়া সময় (গড়)
10.77s
মোট খরচ
$0.096
র‍্যাঙ্ক
#203
মোট আউটপুট টোকেন
2,911
প্রতিক্রিয়া সময় (গড়)
1.99s
মোট খরচ
$0.010
প্রস্তাবিত মডেল GPT-4o-mini

Its score stays close to the best score here (5.0 vs 5.1), while costing about 9.8x less than Mistral Small 4 (medium).

বিস্তারিত তুলনা

মেট্রিক Mistral Small 4 Mistral Small 4 medium প্রকাশ: 2026-03-16 GPT-4o-mini GPT-4o-mini none প্রকাশ: 2024-07-18
স্কোর 5.1 5.0
র‍্যাঙ্ক #195 #203
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.0 9.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 42.4% 22.7%
অস্থির টেস্ট 8 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.913 0.195
মোট খরচ $0.096 $0.010
ইনপুট মূল্য $0.150 / 1M $0.150 / 1M
আউটপুট মূল্য $0.600 / 1M $0.600 / 1M
মোট ইনপুট টোকেন 140,494 53,136
আউটপুট টোকেন 39,462 2,911
রিজনিং টোকেন 92,362 0
প্রতিক্রিয়া সময় (গড়) 10.77s 1.99s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 59.15s 7.58s
প্রতিক্রিয়া সময় (মোট) 236.94s 29.86s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#195 Mistral Small 4

medium
খরচ
$0.006
সময়
47.9s
টোকেন
9,857 tok

#203 GPT-4o-mini

none
খরচ
$0.001
সময়
6.6s
টোকেন
742 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0

দ্রুত তুলনা

তুলনার জুটি বদলান