নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-4o-mini vs Poolside: Laguna S 2.1

Laguna S 2.1 (low) average score-এ এগিয়ে: 5.0 vs 5.0. GPT-4o-mini-এর benchmark খরচ কম: $0.010 vs $0.091. GPT-4o-mini দ্রুত: 1.99s vs 85.35s, pass rates 22.7% vs 25.8%.

প্রস্তাবিত মডেলGPT-4o-miniIts score stays close to the best score here (5.0 vs 5.0), while costing about 9.3x less than Laguna S 2.1 (low).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক GPT-4o-mini GPT-4o-mini none প্রকাশ: 2024-07-18 Laguna S 2.1 Laguna S 2.1 low প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য
স্কোর 5.0 5.0
র‍্যাঙ্ক #183 #181
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 9.9 7.8
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 22.7% 25.8%
অস্থির টেস্ট 0 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.195 3.022
মোট খরচ $0.010 $0.091
ইনপুট মূল্য $0.150 / 1M $0.100 / 1M
আউটপুট মূল্য $0.600 / 1M $0.200 / 1M
মোট ইনপুট টোকেন 53,136 118,746
আউটপুট টোকেন 2,911 67,823
রিজনিং টোকেন 0 383,885
প্রতিক্রিয়া সময় (গড়) 1.99s 85.35s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 7.58s 814.73s
প্রতিক্রিয়া সময় (মোট) 29.86s 1877.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#183 GPT-4o-mini

none
খরচ
$0.001
সময়
6.6s
টোকেন
742 tok

#181 Laguna S 2.1

low
খরচ
$0.001
সময়
6.6s
টোকেন
1,314 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

দ্রুত তুলনা

তুলনার জুটি বদলান