নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral: Mistral Small 4 vs Poolside: Laguna S 2.1

Mistral Small 4 (medium) average score-এ এগিয়ে: 5.1 vs 5.0. Laguna S 2.1 (low)-এর benchmark খরচ কম: $0.091 vs $0.096. Mistral Small 4 (medium) দ্রুত: 10.77s vs 85.35s, pass rates 42.4% vs 25.8%.

প্রস্তাবিত মডেলMistral Small 4 (medium)It has the best score here (5.1), while responding about 7.9x faster than Laguna S 2.1 (low).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Mistral Small 4 Mistral Small 4 medium প্রকাশ: 2026-03-16 Laguna S 2.1 Laguna S 2.1 low প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য
স্কোর 5.1 5.0
র‍্যাঙ্ক #175 #181
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 7.0 7.8
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 42.4% 25.8%
অস্থির টেস্ট 8 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.913 3.022
মোট খরচ $0.096 $0.091
ইনপুট মূল্য $0.150 / 1M $0.100 / 1M
আউটপুট মূল্য $0.600 / 1M $0.200 / 1M
মোট ইনপুট টোকেন 140,494 118,746
আউটপুট টোকেন 39,462 67,823
রিজনিং টোকেন 92,362 383,885
প্রতিক্রিয়া সময় (গড়) 10.77s 85.35s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 59.15s 814.73s
প্রতিক্রিয়া সময় (মোট) 236.94s 1877.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#175 Mistral Small 4

medium
খরচ
$0.006
সময়
47.9s
টোকেন
9,857 tok

#181 Laguna S 2.1

low
খরচ
$0.001
সময়
6.6s
টোকেন
1,314 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

দ্রুত তুলনা

তুলনার জুটি বদলান