নেভিগেশন
AI BENCHY
Advertise here

GPT-5.6 Luna vs Qwen3.6 35B A3B

average score প্রায় সমান: 5.4 vs 5.3. Qwen3.6 35B A3B-এর benchmark খরচ কম: $0.061 vs $0.142. GPT-5.6 Luna দ্রুত: 1.50s vs 5.52s, pass rates 34.9% vs 31.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#172
মোট আউটপুট টোকেন
6,709
প্রতিক্রিয়া সময় (গড়)
1.50s
মোট খরচ
$0.142
র‍্যাঙ্ক
#175
মোট আউটপুট টোকেন
46,957
প্রতিক্রিয়া সময় (গড়)
5.52s
মোট খরচ
$0.061
প্রস্তাবিত মডেল GPT-5.6 Luna

It has the best score here (5.4), while responding about 3.7x faster than Qwen3.6 35B A3B.

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Luna GPT-5.6 Luna none প্রকাশ: 2026-07-09 Qwen3.6 35B A3B Qwen3.6 35B A3B none প্রকাশ: 2026-04-20
স্কোর 5.4 5.3
র‍্যাঙ্ক #172 #175
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.8 7.7
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 34.9% 31.8%
অস্থির টেস্ট 3 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.360 1.496
মোট খরচ $0.142 $0.061
ইনপুট মূল্য $1.000 / 1M $0.140 / 1M
আউটপুট মূল্য $6.000 / 1M $1.000 / 1M
মোট ইনপুট টোকেন 101,323 93,979
আউটপুট টোকেন 6,709 46,957
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 1.50s 5.52s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 10.57s 39.54s
প্রতিক্রিয়া সময় (মোট) 32.91s 110.40s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#172 GPT-5.6 Luna

none
খরচ
$0.016
সময়
15.8s
টোকেন
2,685 tok

#175 Qwen3.6 35B A3B

none
খরচ
$0.008
সময়
30.1s
টোকেন
6,317 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Qwen3.6 35B A3B 5.5 10.0 33.3% 0 8.77s 7,911 11,161 0

দ্রুত তুলনা

তুলনার জুটি বদলান