নেভিগেশন
AI BENCHY
Advertise here

OpenAI: gpt-oss-120b vs Poolside: Laguna S 2.1

Laguna S 2.1 average score-এ এগিয়ে: 4.5 vs 3.7. gpt-oss-120b-এর benchmark খরচ কম: $0.010 vs $0.025. Laguna S 2.1 দ্রুত: 11.67s vs 21.61s, pass rates 33.3% vs 15.2%.

প্রস্তাবিত মডেলLaguna S 2.1It has the best score here (4.5), while responding about 1.9x faster than gpt-oss-120b.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক gpt-oss-120b gpt-oss-120b none প্রকাশ: 2025-08-05 বিনামূল্যে উপলভ্য Laguna S 2.1 Laguna S 2.1 none প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য
স্কোর 3.7 4.5
র‍্যাঙ্ক #216 #200
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.8 8.8
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 33.3% 15.2%
অস্থির টেস্ট 2 3
মোট রান 57 66
প্রতি ফলাফলে খরচ 0.168 1.205
মোট খরচ $0.010 $0.025
ইনপুট মূল্য $0.037 / 1M $0.100 / 1M
আউটপুট মূল্য $0.170 / 1M $0.200 / 1M
মোট ইনপুট টোকেন 9,081 125,598
আউটপুট টোকেন 51,664 57,634
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 21.61s 11.67s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 113.71s 200.52s
প্রতিক্রিয়া সময় (মোট) 345.79s 256.80s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#216 gpt-oss-120b

none
এই মডেলের জন্য এখনও কোনো শোকেস ফলাফল তৈরি হয়নি।
খরচ
$0.000
সময়
-
টোকেন
0 tok

#200 Laguna S 2.1

none
খরচ
$0.001
সময়
7.6s
টোকেন
1,345 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0
Laguna S 2.1 3.4 9.7 0.0% 0 550ms 7,917 424 0

দ্রুত তুলনা

তুলনার জুটি বদলান