নেভিগেশন
AI BENCHY
Advertise here

Mistral Small 4 (medium) vs GPT-5.4 Nano

Mistral Small 4 (medium) average score-এ এগিয়ে: 5.1 vs 4.8. GPT-5.4 Nano-এর benchmark খরচ কম: $0.041 vs $0.096. GPT-5.4 Nano দ্রুত: 2.57s vs 10.77s, pass rates 42.4% vs 28.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-07

র‍্যাঙ্ক
#200
মোট আউটপুট টোকেন
131,824
প্রতিক্রিয়া সময় (গড়)
10.77s
মোট খরচ
$0.096
র‍্যাঙ্ক
#214
মোট আউটপুট টোকেন
13,794
প্রতিক্রিয়া সময় (গড়)
2.57s
মোট খরচ
$0.041
প্রস্তাবিত মডেল GPT-5.4 Nano

Its score stays close to the best score here (4.8 vs 5.1), while costing about 2.4x less than Mistral Small 4 (medium).

বিস্তারিত তুলনা

মেট্রিক Mistral Small 4 Mistral Small 4 medium প্রকাশ: 2026-03-16 GPT-5.4 Nano GPT-5.4 Nano none প্রকাশ: 2026-03-17
স্কোর 5.1 4.8
র‍্যাঙ্ক #200 #214
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.0 8.2
বেঞ্চমার্ক কভারেজ 22/22 টেস্ট · 66/66 প্রচেষ্টা 22/22 টেস্ট · 66/66 প্রচেষ্টা
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 42.4% 28.8%
অস্থির টেস্ট 8 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.913 1.011
মোট খরচ $0.096 $0.041
ইনপুট মূল্য $0.150 / 1M $0.200 / 1M
আউটপুট মূল্য $0.600 / 1M $1.250 / 1M
মোট ইনপুট টোকেন 140,494 115,924
আউটপুট টোকেন 39,462 13,794
রিজনিং টোকেন 92,362 0
প্রতিক্রিয়া সময় (গড়) 10.77s 2.57s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 59.15s 25.50s
প্রতিক্রিয়া সময় (মোট) 236.94s 56.51s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#200 Mistral Small 4

medium
খরচ
$0.006
সময়
47.9s
টোকেন
9,857 tok

#214 GPT-5.4 Nano

none
খরচ
$0.008
সময়
46.1s
টোকেন
5,735 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0

দ্রুত তুলনা

তুলনার জুটি বদলান