নেভিগেশন
Advertise here

GPT-6 Luna vs Qwen3.5-122B-A10B

Qwen3.5-122B-A10B average score-এ এগিয়ে: 5.7 vs 5.6. GPT-6 Luna-এর benchmark খরচ কম: $0.012 vs $0.247. Qwen3.5-122B-A10B দ্রুত: 12.93s vs 19.08s, pass rates 42.4% vs 33.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-23

তুলনা করা মডেল

র‍্যাঙ্ক
#260
মোট আউটপুট টোকেন
5,508
প্রতিক্রিয়া সময় (গড়)
19.08s
মোট খরচ
$0.012
র‍্যাঙ্ক
#255
মোট আউটপুট টোকেন
88,459
প্রতিক্রিয়া সময় (গড়)
12.93s
মোট খরচ
$0.247
প্রস্তাবিত মডেল GPT-6 Luna

Its score stays close to the best score here (5.6 vs 5.7), while costing about 21.5x less than Qwen3.5-122B-A10B.

বিস্তারিত তুলনা

মেট্রিক GPT-6 Luna GPT-6 Luna none প্রকাশ: 2026-09-23 Qwen3.5-122B-A10B Qwen3.5-122B-A10B none প্রকাশ: 2026-02-24
স্কোর 5.6 5.7
র‍্যাঙ্ক #260 #255
নির্ভরযোগ্যতা 9.9 10.0
ধারাবাহিকতা 8.1 9.3
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 42.4% 33.3%
অস্থির টেস্ট 5 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.164 4.182
মোট খরচ $0.012 $0.247
ইনপুট মূল্য $0.100 / 1M $0.260 / 1M
আউটপুট মূল্য $0.500 / 1M $2.080 / 1M
মোট ইনপুট টোকেন 87,216 241,575
আউটপুট টোকেন 5,508 88,459
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 19.08s 12.93s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 98.62s 212.63s
প্রতিক্রিয়া সময় (মোট) 419.83s 284.39s
প্যারামিটার ~400B মোট (~17B সক্রিয়) 122B মোট (10B সক্রিয়)
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#260 GPT-6 Luna

none
খরচ
$0.002
সময়
26.0s
টোকেন
3,235 tok

#255 Qwen3.5-122B-A10B

none
খরচ
$0.016
সময়
44.5s
টোকেন
6,431 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-6 Luna 5.5 10.0 33.3% 0 8.04s 7,302 376 0
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0

দ্রুত তুলনা

তুলনার জুটি বদলান