নেভিগেশন
Advertise here

GPT-6 Luna (low) vs Grok 4.20 (medium)

average score প্রায় সমান: 7.0 vs 7.0. GPT-6 Luna (low)-এর benchmark খরচ কম: $0.020 vs $0.805. GPT-6 Luna (low) দ্রুত: 21.96s vs 32.56s, pass rates 62.1% vs 60.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-23

তুলনা করা মডেল

র‍্যাঙ্ক
#159
মোট আউটপুট টোকেন
22,605
প্রতিক্রিয়া সময় (গড়)
21.96s
মোট খরচ
$0.020
র‍্যাঙ্ক
#164
মোট আউটপুট টোকেন
270,259
প্রতিক্রিয়া সময় (গড়)
32.56s
মোট খরচ
$0.805
প্রস্তাবিত মডেল GPT-6 Luna (low)

It has the best score here (7.0), while costing about 41.6x less than Grok 4.20 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-6 Luna GPT-6 Luna low প্রকাশ: 2026-09-23 Grok 4.20 Grok 4.20 medium প্রকাশ: 2026-03-31
স্কোর 7.0 7.0
র‍্যাঙ্ক #159 #164
নির্ভরযোগ্যতা 9.6 10.0
ধারাবাহিকতা 8.5 8.2
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 62.1% 60.6%
অস্থির টেস্ট 4 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.176 10.365
মোট খরচ $0.020 $0.805
ইনপুট মূল্য $0.100 / 1M $1.250 / 1M
আউটপুট মূল্য $0.500 / 1M $2.500 / 1M
মোট ইনপুট টোকেন 80,159 102,986
আউটপুট টোকেন 4,623 5,860
রিজনিং টোকেন 17,982 264,399
প্রতিক্রিয়া সময় (গড়) 21.96s 32.56s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 89.37s 199.66s
প্রতিক্রিয়া সময় (মোট) 483.19s 716.36s
প্যারামিটার ~400B মোট (~17B সক্রিয়) ~1T মোট (~100B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#159 GPT-6 Luna

low
খরচ
$0.002
সময়
19.2s
টোকেন
2,598 tok

#164 SpaceXAI: Grok 4.20

medium
খরচ
$0.041
সময়
110.3s
টোকেন
16,336 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

দ্রুত তুলনা

তুলনার জুটি বদলান