নেভিগেশন
Advertise here

GPT-6 Luna (medium) vs Qwen3.7 Plus (medium)

average score প্রায় সমান: 7.9 vs 7.9. GPT-6 Luna (medium)-এর benchmark খরচ কম: $0.031 vs $0.277. GPT-6 Luna (medium) দ্রুত: 15.87s vs 53.51s, pass rates 72.7% vs 75.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-23

তুলনা করা মডেল

র‍্যাঙ্ক
#94
মোট আউটপুট টোকেন
45,154
প্রতিক্রিয়া সময় (গড়)
15.87s
মোট খরচ
$0.031
র‍্যাঙ্ক
#95
মোট আউটপুট টোকেন
187,337
প্রতিক্রিয়া সময় (গড়)
53.51s
মোট খরচ
$0.277
প্রস্তাবিত মডেল GPT-6 Luna (medium)

It has the best score here (7.9), while costing about 9.1x less than Qwen3.7 Plus (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-6 Luna GPT-6 Luna medium প্রকাশ: 2026-09-23 Qwen3.7 Plus Qwen3.7 Plus medium প্রকাশ: 2026-06-03
স্কোর 7.9 7.9
র‍্যাঙ্ক #94 #95
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.9 8.9
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.7% 75.8%
অস্থির টেস্ট 3 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.218 2.134
মোট খরচ $0.031 $0.277
ইনপুট মূল্য $0.100 / 1M $0.320 / 1M
আউটপুট মূল্য $0.500 / 1M $1.280 / 1M
মোট ইনপুট টোকেন 78,946 115,242
আউটপুট টোকেন 4,635 6,163
রিজনিং টোকেন 40,519 181,174
প্রতিক্রিয়া সময় (গড়) 15.87s 53.51s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 35.14s 315.30s
প্রতিক্রিয়া সময় (মোট) 349.09s 1177.25s
প্যারামিটার ~400B মোট (~17B সক্রিয়) ~397B মোট (~17B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 GPT-6 Luna

medium
খরচ
$0.002
সময়
23.6s
টোকেন
2,966 tok

#95 Qwen3.7 Plus

medium
খরচ
$0.018
সময়
193.2s
টোকেন
10,821 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576

দ্রুত তুলনা

তুলনার জুটি বদলান