নেভিগেশন
AI BENCHY
Advertise here

GPT-5.6 Luna (low) vs gpt-oss-120b (medium)

average score প্রায় সমান: 6.2 vs 6.1. gpt-oss-120b (medium)-এর benchmark খরচ কম: $0.019 vs $0.026. GPT-5.6 Luna (low) দ্রুত: 5.20s vs 20.81s, pass rates 54.5% vs 50.0%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-15

র‍্যাঙ্ক
#165
মোট আউটপুট টোকেন
26,286
প্রতিক্রিয়া সময় (গড়)
5.20s
মোট খরচ
$0.026
র‍্যাঙ্ক
#169
মোট আউটপুট টোকেন
98,282
প্রতিক্রিয়া সময় (গড়)
20.81s
মোট খরচ
$0.019
প্রস্তাবিত মডেল GPT-5.6 Luna (low)

It has the best score here (6.2), while responding about 4.0x faster than gpt-oss-120b (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Luna GPT-5.6 Luna low প্রকাশ: 2026-07-09 gpt-oss-120b gpt-oss-120b medium প্রকাশ: 2025-08-05
স্কোর 6.2 6.1
র‍্যাঙ্ক #165 #169
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.2 8.0
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 54.5% 50.0%
অস্থির টেস্ট 5 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.437 0.224
মোট খরচ $0.026 $0.019
ইনপুট মূল্য $0.100 / 1M $0.030 / 1M
আউটপুট মূল্য $0.600 / 1M $0.170 / 1M
মোট ইনপুট টোকেন 96,355 108,767
আউটপুট টোকেন 8,213 29,378
রিজনিং টোকেন 18,073 68,904
প্রতিক্রিয়া সময় (গড়) 5.20s 20.81s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 19.44s 68.16s
প্রতিক্রিয়া সময় (মোট) 114.46s 332.88s
প্যারামিটার ~400B মোট (~17B সক্রিয়) 117B মোট (5.1B সক্রিয়)
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#165 GPT-5.6 Luna

low
খরচ
$0.011
সময়
10.2s
টোকেন
1,897 tok

#169 gpt-oss-120b

medium
খরচ
$0.001
সময়
26.7s
টোকেন
555 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973

দ্রুত তুলনা

তুলনার জুটি বদলান