নেভিগেশন
AI BENCHY
Advertise here

GPT-5.4 Mini (medium) vs GPT-5.6 Luna (medium)

average score প্রায় সমান: 7.5 vs 7.4. GPT-5.6 Luna (medium)-এর benchmark খরচ কম: $0.072 vs $0.786. GPT-5.6 Luna (medium) দ্রুত: 7.43s vs 26.72s, pass rates 68.2% vs 62.1%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-20

র‍্যাঙ্ক
#88
মোট আউটপুট টোকেন
158,344
প্রতিক্রিয়া সময় (গড়)
26.72s
মোট খরচ
$0.786
র‍্যাঙ্ক
#93
মোট আউটপুট টোকেন
44,525
প্রতিক্রিয়া সময় (গড়)
7.43s
মোট খরচ
$0.072
প্রস্তাবিত মডেল GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 11.0x less than GPT-5.4 Mini (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.4 Mini GPT-5.4 Mini medium প্রকাশ: 2026-03-17 GPT-5.6 Luna GPT-5.6 Luna medium প্রকাশ: 2026-07-09
স্কোর 7.5 7.4
র‍্যাঙ্ক #88 #93
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.1 9.2
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 68.2% 62.1%
অস্থির টেস্ট 5 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 6.546 2.601
মোট খরচ $0.786 $0.072
ইনপুট মূল্য $0.750 / 1M $0.200 / 1M
আউটপুট মূল্য $4.500 / 1M $1.200 / 1M
মোট ইনপুট টোকেন 97,164 89,685
আউটপুট টোকেন 6,211 5,701
রিজনিং টোকেন 152,133 38,824
প্রতিক্রিয়া সময় (গড়) 26.72s 7.43s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 138.75s 29.85s
প্রতিক্রিয়া সময় (মোট) 587.90s 163.54s
প্যারামিটার ~400B মোট (~17B সক্রিয়) ~400B মোট (~17B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#88 GPT-5.4 Mini

medium
খরচ
$0.056
সময়
95.5s
টোকেন
12,464 tok

#93 GPT-5.6 Luna

medium
খরচ
$0.014
সময়
14.6s
টোকেন
2,362 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

দ্রুত তুলনা

তুলনার জুটি বদলান