নেভিগেশন
AI BENCHY
Advertise here

GPT-5.6 Luna (medium) vs Grok 4.6 (low)

GPT-5.6 Luna (medium) average score-এ এগিয়ে: 7.4 vs 7.4. GPT-5.6 Luna (medium)-এর benchmark খরচ কম: $0.036 vs $0.449. GPT-5.6 Luna (medium) দ্রুত: 7.43s vs 14.55s, pass rates 62.1% vs 69.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-14

র‍্যাঙ্ক
#90
মোট আউটপুট টোকেন
44,525
প্রতিক্রিয়া সময় (গড়)
7.43s
মোট খরচ
$0.036
র‍্যাঙ্ক
#93
মোট আউটপুট টোকেন
38,048
প্রতিক্রিয়া সময় (গড়)
14.55s
মোট খরচ
$0.449
প্রস্তাবিত মডেল GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 12.6x less than Grok 4.6 (low).

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Luna GPT-5.6 Luna medium প্রকাশ: 2026-07-09 Grok 4.6 Grok 4.6 low প্রকাশ: 2026-08-12
স্কোর 7.4 7.4
র‍্যাঙ্ক #90 #93
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.2 9.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 62.1% 69.7%
অস্থির টেস্ট 2 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.601 2.989
মোট খরচ $0.036 $0.449
ইনপুট মূল্য $0.100 / 1M $2.000 / 1M
আউটপুট মূল্য $0.600 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 89,685 109,960
আউটপুট টোকেন 5,701 5,124
রিজনিং টোকেন 38,824 32,924
প্রতিক্রিয়া সময় (গড়) 7.43s 14.55s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 29.85s 26.46s
প্রতিক্রিয়া সময় (মোট) 163.54s 320.17s
প্যারামিটার ~400B মোট (~17B সক্রিয়) ~1.7T মোট (~170B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#90 GPT-5.6 Luna

medium
খরচ
$0.014
সময়
14.6s
টোকেন
2,362 tok

#93 SpaceXAI: Grok 4.6

low
খরচ
$0.011
সময়
26.0s
টোকেন
1,941 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

দ্রুত তুলনা

তুলনার জুটি বদলান