নেভিগেশন
AI BENCHY
Advertise here

GPT-5.6 Luna vs Qwen3.6 27B

Qwen3.6 27B average score-এ এগিয়ে: 5.5 vs 5.4. GPT-5.6 Luna-এর benchmark খরচ কম: $0.029 vs $0.116. GPT-5.6 Luna দ্রুত: 1.50s vs 10.62s, pass rates 36.4% vs 45.5%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-20

র‍্যাঙ্ক
#221
মোট আউটপুট টোকেন
6,709
প্রতিক্রিয়া সময় (গড়)
1.50s
মোট খরচ
$0.029
র‍্যাঙ্ক
#214
মোট আউটপুট টোকেন
16,156
প্রতিক্রিয়া সময় (গড়)
10.62s
মোট খরচ
$0.116
প্রস্তাবিত মডেল GPT-5.6 Luna

Its score stays close to the best score here (5.4 vs 5.5), while costing about 4.1x less than Qwen3.6 27B.

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Luna GPT-5.6 Luna none প্রকাশ: 2026-07-09 Qwen3.6 27B Qwen3.6 27B none প্রকাশ: 2026-04-20
স্কোর 5.4 5.5
র‍্যাঙ্ক #221 #214
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.8 7.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 36.4% 45.5%
অস্থির টেস্ট 3 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.357 1.220
মোট খরচ $0.029 $0.116
ইনপুট মূল্য $0.200 / 1M $0.600 / 1M
আউটপুট মূল্য $1.200 / 1M $3.600 / 1M
মোট ইনপুট টোকেন 101,332 95,805
আউটপুট টোকেন 6,709 16,156
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 1.50s 10.62s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 10.57s 156.31s
প্রতিক্রিয়া সময় (মোট) 33.05s 233.68s
প্যারামিটার ~400B মোট (~17B সক্রিয়) 27B
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#221 GPT-5.6 Luna

none
খরচ
$0.016
সময়
15.8s
টোকেন
2,685 tok

#214 Qwen3.6 27B

none
খরচ
$0.009
সময়
83.0s
টোকেন
4,549 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Qwen3.6 27B 5.5 10.0 33.3% 0 4.16s 7,913 539 0

দ্রুত তুলনা

তুলনার জুটি বদলান