Advertise here
#390

GPT-6 Luna Decisions

OpenAI প্রকাশ: 2026-10-07 পরীক্ষিত হয়েছে: 2026-10-07 11:04 openai/gpt-6-luna-decisions::none
~400B মোট (~17B সক্রিয়)MoEবন্ধ উৎসআনুমানিক

সারাংশ

GPT-6 Luna Decisions AI BENCHY-তে 2.4 স্কোর করে এবং #390 স্থানে আছে। এর reliability 10.0, pass rate 13.0%, মোট খরচ $0.005, এবং গড় response time 495ms.

GPT-6 Luna Decisions কে আলাদা করে যা: একই ধরনের মডেলের তুলনায় এটি লক্ষণীয়ভাবে দ্রুত।

মডেলের তথ্য

গবেষণার তারিখ: 2026-10-07

আনুমানিক
প্যারামিটার
~400B মোট (~17B সক্রিয়)
আর্কিটেকচার
MoE
উপলভ্যতা
বন্ধ উৎস
লাইসেন্স
-

সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।

ধারাবাহিকতা

5.2

মোট আউটপুট টোকেন

0

মোট ইনপুট টোকেন

47,583

ইনপুট মূল্য

$0.100 / 1M

আউটপুট মূল্য

$0.000 / 1M

ক্যাশ পড়ার মূল্য

$0.000 / 1M

ক্যাশ লেখার মূল্য

$0.000 / 1M

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

সঠিক টেস্ট

ভুল টেস্ট: 9

প্রতি চেষ্টায় পাস রেট: 13.0%

বেঞ্চমার্ক কভারেজ: 36/69 প্রচেষ্টা. অ্যাডাপ্টার বিকল্প সরবরাহ করে। 12/23টি পরীক্ষা সমর্থিত। অন্য পরীক্ষাগুলো অসমর্থিত, ব্যর্থ নয়। স্কোর সম্পূর্ণ পরীক্ষাসেটের ভিত্তিতে গণনা করা হয়।

অস্থির টেস্ট

0

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

495ms

প্রতিক্রিয়া সময় (সর্বোচ্চ): 842ms

প্রতিক্রিয়া সময় (মোট): 5.94s

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
স্বায়ত্তশাসিত এজেন্টের কাজ 0.0 0.0
অ্যান্টি-এআই কৌশল 2.3 7.5
কোডিং 2.5 6.7
সমন্বিত 0.0 0.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 5.3 10.0
Sadharon Buddhimotta 0.0 0.0
নির্দেশনা অনুসরণ 1.5 5.0
ধাঁধা সমাধান 1.7 3.3
টুল কলিং 0.0 0.0
সাধারণ জ্ঞান 0.0 0.0

তুলনা করা মডেল