নেভিগেশন
Advertise here

GPT-6 Luna (medium) vs Grok 4.7 (low)

average score প্রায় সমান: 7.9 vs 7.9. GPT-6 Luna (medium)-এর benchmark খরচ কম: $0.031 vs $1.320. GPT-6 Luna (medium) দ্রুত: 15.87s vs 59.02s, pass rates 72.7% vs 77.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-23

তুলনা করা মডেল

র‍্যাঙ্ক
#94
মোট আউটপুট টোকেন
45,154
প্রতিক্রিয়া সময় (গড়)
15.87s
মোট খরচ
$0.031
র‍্যাঙ্ক
#89
মোট আউটপুট টোকেন
231,848
প্রতিক্রিয়া সময় (গড়)
59.02s
মোট খরচ
$1.320
প্রস্তাবিত মডেল GPT-6 Luna (medium)

It has the best score here (7.9), while costing about 43.3x less than Grok 4.7 (low).

বিস্তারিত তুলনা

মেট্রিক GPT-6 Luna GPT-6 Luna medium প্রকাশ: 2026-09-23 Grok 4.7 Grok 4.7 low প্রকাশ: 2026-09-21
স্কোর 7.9 7.9
র‍্যাঙ্ক #94 #89
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.9 8.3
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.7% 77.3%
অস্থির টেস্ট 3 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.218 9.422
মোট খরচ $0.031 $1.320
ইনপুট মূল্য $0.100 / 1M $1.600 / 1M
আউটপুট মূল্য $0.500 / 1M $4.800 / 1M
মোট ইনপুট টোকেন 78,946 128,832
আউটপুট টোকেন 4,635 6,840
রিজনিং টোকেন 40,519 225,008
প্রতিক্রিয়া সময় (গড়) 15.87s 59.02s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 35.14s 389.63s
প্রতিক্রিয়া সময় (মোট) 349.09s 1298.42s
প্যারামিটার ~400B মোট (~17B সক্রিয়) ~1.7T মোট (~170B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 GPT-6 Luna

medium
খরচ
$0.002
সময়
23.6s
টোকেন
2,966 tok

#89 SpaceXAI: Grok 4.7

low
খরচ
$0.007
সময়
15.2s
টোকেন
1,537 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222
Grok 4.7 8.4 7.4 88.9% 1 189.08s 9,579 346 99,053

দ্রুত তুলনা

তুলনার জুটি বদলান