নেভিগেশন
Advertise here

GPT-5.6 Luna (high) vs Qwen3.7 Max

GPT-5.6 Luna (high) average score-এ এগিয়ে: 8.0 vs 7.9. GPT-5.6 Luna (high)-এর benchmark খরচ কম: $0.207 vs $0.492. Qwen3.7 Max দ্রুত: 7.85s vs 18.39s, pass rates 71.0% vs 69.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#91
মোট আউটপুট টোকেন
139,395
প্রতিক্রিয়া সময় (গড়)
18.39s
মোট খরচ
$0.207
র‍্যাঙ্ক
#100
মোট আউটপুট টোকেন
20,670
প্রতিক্রিয়া সময় (গড়)
7.85s
মোট খরচ
$0.492
প্রস্তাবিত মডেল GPT-5.6 Luna (high)

It has the best score here (8.0), while costing about 2.4x less than Qwen3.7 Max.

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Luna GPT-5.6 Luna high প্রকাশ: 2026-07-09 Qwen3.7 Max Qwen3.7 Max none প্রকাশ: 2026-05-22
স্কোর 8.0 7.9
র‍্যাঙ্ক #91 #100
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 8.6 10.0
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 71.0% 69.6%
অস্থির টেস্ট 4 0
মোট রান 69 69
প্রতি ফলাফলে খরচ 5.882 3.070
মোট খরচ $0.207 $0.492
ইনপুট মূল্য $0.200 / 1M $1.475 / 1M
আউটপুট মূল্য $1.200 / 1M $4.425 / 1M
মোট ইনপুট টোকেন 197,896 243,553
আউটপুট টোকেন 6,211 20,670
রিজনিং টোকেন 133,184 0
প্রতিক্রিয়া সময় (গড়) 18.39s 7.85s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 111.09s 80.34s
প্রতিক্রিয়া সময় (মোট) 422.93s 180.65s
প্যারামিটার ~400B মোট (~17B সক্রিয়) ~1T মোট (~40B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 GPT-5.6 Luna

high
খরচ
$0.033
সময়
34.2s
টোকেন
5,484 tok

#100 Qwen3.7 Max

none
খরচ
$0.046
সময়
195.0s
টোকেন
12,171 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

দ্রুত তুলনা

তুলনার জুটি বদলান