নেভিগেশন
Advertise here

DeepSeek V3.2 (medium) vs GPT-6 Luna (low)

average score প্রায় সমান: 7.0 vs 7.0. GPT-6 Luna (low)-এর benchmark খরচ কম: $0.020 vs $0.078. GPT-6 Luna (low) দ্রুত: 21.96s vs 68.43s, pass rates 65.2% vs 62.1%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-23

তুলনা করা মডেল

র‍্যাঙ্ক
#160
মোট আউটপুট টোকেন
128,787
প্রতিক্রিয়া সময় (গড়)
68.43s
মোট খরচ
$0.078
র‍্যাঙ্ক
#159
মোট আউটপুট টোকেন
22,605
প্রতিক্রিয়া সময় (গড়)
21.96s
মোট খরচ
$0.020
প্রস্তাবিত মডেল GPT-6 Luna (low)

It has the best score here (7.0), while costing about 4.0x less than DeepSeek V3.2 (medium).

বিস্তারিত তুলনা

মেট্রিক DeepSeek V3.2 DeepSeek V3.2 medium প্রকাশ: 2025-12-01 GPT-6 Luna GPT-6 Luna low প্রকাশ: 2026-09-23
স্কোর 7.0 7.0
র‍্যাঙ্ক #160 #159
নির্ভরযোগ্যতা 10.0 9.6
ধারাবাহিকতা 7.4 8.5
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.2% 62.1%
অস্থির টেস্ট 7 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.672 0.176
মোট খরচ $0.078 $0.020
ইনপুট মূল্য $0.269 / 1M $0.100 / 1M
আউটপুট মূল্য $0.400 / 1M $0.500 / 1M
মোট ইনপুট টোকেন 101,056 80,159
আউটপুট টোকেন 11,832 4,623
রিজনিং টোকেন 116,955 17,982
প্রতিক্রিয়া সময় (গড়) 68.43s 21.96s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 376.10s 89.37s
প্রতিক্রিয়া সময় (মোট) 1505.53s 483.19s
প্যারামিটার 671B মোট (37B সক্রিয়) ~400B মোট (~17B সক্রিয়)
উপলভ্যতা উন্মুক্ত উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#160 DeepSeek V3.2

medium
খরচ
$0.001
সময়
53.6s
টোকেন
1,932 tok

#159 GPT-6 Luna

low
খরচ
$0.002
সময়
19.2s
টোকেন
2,598 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

দ্রুত তুলনা

তুলনার জুটি বদলান