নেভিগেশন
Advertise here

GPT-6 Luna (high) vs Grok 4.5 (low)

Grok 4.5 (low) average score-এ এগিয়ে: 7.8 vs 7.7. GPT-6 Luna (high)-এর benchmark খরচ কম: $0.074 vs $1.345. Grok 4.5 (low) দ্রুত: 18.14s vs 20.37s, pass rates 73.9% vs 73.9%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#111
মোট আউটপুট টোকেন
101,587
প্রতিক্রিয়া সময় (গড়)
20.37s
মোট খরচ
$0.074
র‍্যাঙ্ক
#109
মোট আউটপুট টোকেন
121,415
প্রতিক্রিয়া সময় (গড়)
18.14s
মোট খরচ
$1.345
প্রস্তাবিত মডেল GPT-6 Luna (high)

Its score stays close to the best score here (7.7 vs 7.8), while costing about 18.2x less than Grok 4.5 (low).

বিস্তারিত তুলনা

মেট্রিক GPT-6 Luna GPT-6 Luna high প্রকাশ: 2026-09-23 Grok 4.5 Grok 4.5 low প্রকাশ: 2026-07-08
স্কোর 7.7 7.8
র‍্যাঙ্ক #111 #109
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.7 9.3
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 73.9% 73.9%
অস্থির টেস্ট 4 2
মোট রান 69 69
প্রতি ফলাফলে খরচ 0.492 8.404
মোট খরচ $0.074 $1.345
ইনপুট মূল্য $0.100 / 1M $2.000 / 1M
আউটপুট মূল্য $0.500 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 229,986 308,068
আউটপুট টোকেন 6,037 9,218
রিজনিং টোকেন 95,550 112,197
প্রতিক্রিয়া সময় (গড়) 20.37s 18.14s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 106.93s 205.28s
প্রতিক্রিয়া সময় (মোট) 468.52s 417.21s
প্যারামিটার ~400B মোট (~17B সক্রিয়) ~1.7T মোট (~170B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 GPT-6 Luna

high
খরচ
$0.003
সময়
49.2s
টোকেন
5,231 tok

#109 SpaceXAI: Grok 4.5

low
খরচ
$0.011
সময়
12.4s
টোকেন
2,018 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

দ্রুত তুলনা

তুলনার জুটি বদলান