নেভিগেশন
Advertise here

GPT-5.6 Luna (medium) vs Grok 4.7 (low)

average score প্রায় সমান: 7.4 vs 7.4. GPT-5.6 Luna (medium)-এর benchmark খরচ কম: $0.101 vs $2.263. GPT-5.6 Luna (medium) দ্রুত: 9.64s vs 63.19s, pass rates 62.3% vs 73.9%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#122
মোট আউটপুট টোকেন
47,986
প্রতিক্রিয়া সময় (গড়)
9.64s
মোট খরচ
$0.101
র‍্যাঙ্ক
#127
মোট আউটপুট টোকেন
255,329
প্রতিক্রিয়া সময় (গড়)
63.19s
মোট খরচ
$2.263
প্রস্তাবিত মডেল GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 22.6x less than Grok 4.7 (low).

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Luna GPT-5.6 Luna medium প্রকাশ: 2026-07-09 Grok 4.7 Grok 4.7 low প্রকাশ: 2026-09-21
স্কোর 7.4 7.4
র‍্যাঙ্ক #122 #127
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.0 8.3
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 62.3% 73.9%
অস্থির টেস্ট 3 5
মোট রান 69 69
প্রতি ফলাফলে খরচ 2.822 13.804
মোট খরচ $0.101 $2.263
ইনপুট মূল্য $0.200 / 1M $2.000 / 1M
আউটপুট মূল্য $1.200 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 212,780 365,119
আউটপুট টোকেন 6,849 8,118
রিজনিং টোকেন 41,137 247,211
প্রতিক্রিয়া সময় (গড়) 9.64s 63.19s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 58.09s 389.63s
প্রতিক্রিয়া সময় (মোট) 221.62s 1453.28s
প্যারামিটার ~400B মোট (~17B সক্রিয়) ~1.7T মোট (~170B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT-5.6 Luna

medium
খরচ
$0.014
সময়
14.6s
টোকেন
2,362 tok

#127 SpaceXAI: Grok 4.7

low
খরচ
$0.007
সময়
15.2s
টোকেন
1,537 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Grok 4.7 8.4 7.4 88.9% 1 189.08s 9,579 346 99,053

দ্রুত তুলনা

তুলনার জুটি বদলান