সারাংশ
GPT-6 Luna Decisions AI BENCHY-তে 2.4 স্কোর করে এবং #390 স্থানে আছে। এর reliability 10.0, pass rate 13.0%, মোট খরচ $0.005, এবং গড় response time 495ms.
GPT-6 Luna Decisions কে আলাদা করে যা: একই ধরনের মডেলের তুলনায় এটি লক্ষণীয়ভাবে দ্রুত।
মডেলের তথ্য
গবেষণার তারিখ: 2026-10-07
- প্যারামিটার
- ~400B মোট (~17B সক্রিয়)
- আর্কিটেকচার
- MoE
- উপলভ্যতা
- বন্ধ উৎস
- লাইসেন্স
- -
সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।
2.4
ধারাবাহিকতা
5.2
10.0
$0.005
মোট আউটপুট টোকেন
0
মোট ইনপুট টোকেন
47,583
ইনপুট মূল্য
$0.100 / 1M
আউটপুট মূল্য
$0.000 / 1M
ক্যাশ পড়ার মূল্য
$0.000 / 1M
ক্যাশ লেখার মূল্য
$0.000 / 1M
ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।
ভুল টেস্ট: 9
প্রতি চেষ্টায় পাস রেট: 13.0%
বেঞ্চমার্ক কভারেজ: 36/69 প্রচেষ্টা. অ্যাডাপ্টার বিকল্প সরবরাহ করে। 12/23টি পরীক্ষা সমর্থিত। অন্য পরীক্ষাগুলো অসমর্থিত, ব্যর্থ নয়। স্কোর সম্পূর্ণ পরীক্ষাসেটের ভিত্তিতে গণনা করা হয়।
অস্থির টেস্ট
0
অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।
চার্ট
প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।
স্কোর vs মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
দ্রুত তুলনা
বিভাগভিত্তিক বিশ্লেষণ
| বিভাগ | স্কোর | ধারাবাহিকতা | সঠিক টেস্ট |
|---|---|---|---|
| স্বায়ত্তশাসিত এজেন্টের কাজ | 0.0 | 0.0 | |
| অ্যান্টি-এআই কৌশল | 2.3 | 7.5 | |
| কোডিং | 2.5 | 6.7 | |
| সমন্বিত | 0.0 | 0.0 | |
| ডেটা পার্সিং ও নিষ্কাশন | 10.0 | 10.0 | |
| ডোমেইন-নির্দিষ্ট | 5.3 | 10.0 | |
| Sadharon Buddhimotta | 0.0 | 0.0 | |
| নির্দেশনা অনুসরণ | 1.5 | 5.0 | |
| ধাঁধা সমাধান | 1.7 | 3.3 | |
| টুল কলিং | 0.0 | 0.0 | |
| সাধারণ জ্ঞান | 0.0 | 0.0 |