নেভিগেশন
AI BENCHY
Advertise here

GPT-5.6 Luna vs Laguna S 2.1 (high)

average score প্রায় সমান: 5.4 vs 5.4. GPT-5.6 Luna-এর benchmark খরচ কম: $0.029 vs $0.114. GPT-5.6 Luna দ্রুত: 1.50s vs 111.60s, pass rates 36.4% vs 27.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-04

র‍্যাঙ্ক
#241
মোট আউটপুট টোকেন
6,709
প্রতিক্রিয়া সময় (গড়)
1.50s
মোট খরচ
$0.029
র‍্যাঙ্ক
#245
মোট আউটপুট টোকেন
584,864
প্রতিক্রিয়া সময় (গড়)
111.60s
মোট খরচ
$0.114
প্রস্তাবিত মডেল GPT-5.6 Luna

It has the best score here (5.4), while costing about 4.0x less than Laguna S 2.1 (high).

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Luna GPT-5.6 Luna none প্রকাশ: 2026-07-09 Laguna S 2.1 Laguna S 2.1 high প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য
স্কোর 5.4 5.4
র‍্যাঙ্ক #241 #245
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.8 8.1
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 36.4% 27.3%
অস্থির টেস্ট 3 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.357 3.153
মোট খরচ $0.029 $0.114
ইনপুট মূল্য $0.200 / 1M $0.090 / 1M
আউটপুট মূল্য $1.200 / 1M $0.180 / 1M
মোট ইনপুট টোকেন 101,332 208,937
আউটপুট টোকেন 6,709 175,588
রিজনিং টোকেন 0 409,276
প্রতিক্রিয়া সময় (গড়) 1.50s 111.60s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 10.57s 1190.11s
প্রতিক্রিয়া সময় (মোট) 33.05s 2455.24s
প্যারামিটার ~400B মোট (~17B সক্রিয়) 118B মোট (8B সক্রিয়)
উপলভ্যতা বন্ধ উৎস ওজন উপলভ্য

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#241 GPT-5.6 Luna

none
খরচ
$0.016
সময়
15.8s
টোকেন
2,685 tok

#245 Laguna S 2.1

high
খরচ
$0.001
সময়
6.8s
টোকেন
1,389 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009

দ্রুত তুলনা

তুলনার জুটি বদলান