নেভিগেশন
AI BENCHY
Advertise here

OpenAI: GPT-5.4 Nano vs Poolside: Laguna S 2.1

Laguna S 2.1 (low) average score-এ এগিয়ে: 5.0 vs 4.8. GPT-5.4 Nano-এর benchmark খরচ কম: $0.041 vs $0.091. GPT-5.4 Nano দ্রুত: 2.57s vs 85.35s, pass rates 28.8% vs 25.8%.

প্রস্তাবিত মডেলGPT-5.4 NanoIts score stays close to the best score here (4.8 vs 5.0), while costing about 2.2x less than Laguna S 2.1 (low).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক GPT-5.4 Nano GPT-5.4 Nano none প্রকাশ: 2026-03-17 Laguna S 2.1 Laguna S 2.1 low প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য
স্কোর 4.8 5.0
র‍্যাঙ্ক #189 #181
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 8.2 7.8
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 28.8% 25.8%
অস্থির টেস্ট 5 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.011 3.022
মোট খরচ $0.041 $0.091
ইনপুট মূল্য $0.200 / 1M $0.100 / 1M
আউটপুট মূল্য $1.250 / 1M $0.200 / 1M
মোট ইনপুট টোকেন 115,924 118,746
আউটপুট টোকেন 13,794 67,823
রিজনিং টোকেন 0 383,885
প্রতিক্রিয়া সময় (গড়) 2.57s 85.35s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 25.50s 814.73s
প্রতিক্রিয়া সময় (মোট) 56.51s 1877.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#189 GPT-5.4 Nano

none
খরচ
$0.008
সময়
46.1s
টোকেন
5,735 tok

#181 Laguna S 2.1

low
খরচ
$0.001
সময়
6.6s
টোকেন
1,314 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

দ্রুত তুলনা

তুলনার জুটি বদলান