নেভিগেশন
AI BENCHY
Advertise here

GPT-5.6 Luna vs Laguna S 2.1 (medium)

average score প্রায় সমান: 5.4 vs 5.4. GPT-5.6 Luna-এর benchmark খরচ কম: $0.029 vs $0.053. GPT-5.6 Luna দ্রুত: 1.50s vs 58.42s, pass rates 36.4% vs 24.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-04

র‍্যাঙ্ক
#241
মোট আউটপুট টোকেন
6,709
প্রতিক্রিয়া সময় (গড়)
1.50s
মোট খরচ
$0.029
র‍্যাঙ্ক
#239
মোট আউটপুট টোকেন
339,595
প্রতিক্রিয়া সময় (গড়)
58.42s
মোট খরচ
$0.053
প্রস্তাবিত মডেল GPT-5.6 Luna

It has the best score here (5.4), while costing about 1.8x less than Laguna S 2.1 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Luna GPT-5.6 Luna none প্রকাশ: 2026-07-09 Laguna S 2.1 Laguna S 2.1 medium প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য
স্কোর 5.4 5.4
র‍্যাঙ্ক #241 #239
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.8 8.8
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 36.4% 24.2%
অস্থির টেস্ট 3 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.357 1.451
মোট খরচ $0.029 $0.053
ইনপুট মূল্য $0.200 / 1M $0.090 / 1M
আউটপুট মূল্য $1.200 / 1M $0.180 / 1M
মোট ইনপুট টোকেন 101,332 86,647
আউটপুট টোকেন 6,709 97,298
রিজনিং টোকেন 0 242,297
প্রতিক্রিয়া সময় (গড়) 1.50s 58.42s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 10.57s 560.31s
প্রতিক্রিয়া সময় (মোট) 33.05s 1285.26s
প্যারামিটার ~400B মোট (~17B সক্রিয়) 118B মোট (8B সক্রিয়)
উপলভ্যতা বন্ধ উৎস ওজন উপলভ্য

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#241 GPT-5.6 Luna

none
খরচ
$0.016
সময়
15.8s
টোকেন
2,685 tok

#239 Laguna S 2.1

medium
খরচ
$0.001
সময়
4.0s
টোকেন
867 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718

দ্রুত তুলনা

তুলনার জুটি বদলান