নেভিগেশন
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6 Luna Decisions (default) vs Grok 4.20

Grok 4.20 average score-এ এগিয়ে: 3.4 vs 2.4. GPT-6 Luna Decisions (default)-এর benchmark খরচ কম: $0.005 vs $0.057. GPT-6 Luna Decisions (default) দ্রুত: 495ms vs 1.11s, pass rates 13.0% vs 26.1%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-07

তুলনা করা মডেল

র‍্যাঙ্ক
#390
মোট আউটপুট টোকেন
0
প্রতিক্রিয়া সময় (গড়)
495ms
মোট খরচ
$0.005
র‍্যাঙ্ক
#376
মোট আউটপুট টোকেন
1,923
প্রতিক্রিয়া সময় (গড়)
1.11s
মোট খরচ
$0.057
প্রস্তাবিত মডেল Grok 4.20

It has the strongest score in this comparison (3.4) and the best overall balance of cost and response time across all 2 models.

বিস্তারিত তুলনা

মেট্রিক GPT-6 Luna Decisions GPT-6 Luna Decisions default প্রকাশ: 2026-10-07 Grok 4.20 Grok 4.20 none প্রকাশ: 2026-03-31
স্কোর 2.4 3.4
র‍্যাঙ্ক #390 #376
নির্ভরযোগ্যতা 10.0 প্রযোজ্য নয়
ধারাবাহিকতা 5.2 7.8
প্রচেষ্টা 36/69 54/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 13.0% 26.1%
অস্থির টেস্ট 0 0
মোট রান 36 54
প্রতি ফলাফলে খরচ 0.159 1.570
মোট খরচ $0.005 $0.057
ইনপুট মূল্য $0.100 / 1M $1.250 / 1M
আউটপুট মূল্য $0.000 / 1M $2.500 / 1M
ক্যাশ পড়ার মূল্য $0.000 / 1M $0.200 / 1M
ক্যাশ লেখার মূল্য $0.000 / 1M প্রযোজ্য নয়
মোট ইনপুট টোকেন 47,583 41,313
আউটপুট টোকেন 0 1,923
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 495ms 1.11s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 842ms 6.04s
প্রতিক্রিয়া সময় (মোট) 5.94s 19.96s
প্যারামিটার ~400B মোট (~17B সক্রিয়) ~1T মোট (~100B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#390 GPT-6 Luna Decisions

default
এই মডেলের জন্য এখনও কোনো শোকেস ফলাফল তৈরি হয়নি।
খরচ
প্রযোজ্য নয়
সময়
-
টোকেন
0 tok

#376 xAI: Grok 4.20

none
খরচ
$0.004
সময়
6.5s
টোকেন
1,367 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

দ্রুত তুলনা

তুলনার জুটি বদলান

Command A+mediumvsGrok 4.20noneCommand A+highvsGrok 4.20noneLing 3.0 TinymediumvsGrok 4.20noneLing 3.0 TinylowvsGrok 4.20noneLing 3.0 TinyhighvsGrok 4.20noneCommand A+lowvsGrok 4.20noneGranite 4.1 8bdefaultvsGrok 4.20noneLing 3.0 TinydefaultvsGrok 4.20noneCommand A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultQwen3.5-9BmediumvsGrok 4.20none