सारांश
GPT-6 Luna Decisions AI BENCHY वर 2.4 स्कोर करते आणि #390 वर आहे. याची reliability 10.0, pass rate 13.0%, एकूण खर्च $0.005, आणि सरासरी response time 495ms आहे.
GPT-6 Luna Decisions खास का आहे: समान मॉडेल्सच्या तुलनेत हे लक्षणीय वेगवान आहे.
मॉडेलची माहिती
संशोधन दिनांक: 2026-10-07
- पॅरामीटर्स
- ~400B एकूण (~17B सक्रिय)
- आर्किटेक्चर
- MoE
- उपलब्धता
- बंद स्रोत
- परवाना
- -
सार्वजनिक पुराव्यावर आधारित सर्वोत्तम अंदाज; प्रदात्याने सर्व मूल्ये जाहीर केलेली नाहीत.
2.4
सुसंगतता
5.2
10.0
$0.005
एकूण आउटपुट टोकन्स
0
एकूण इनपुट टोकन्स
47,583
इनपुट किंमत
$0.100 / 1M
आउटपुट किंमत
$0.000 / 1M
कॅश वाचण्याची किंमत
$0.000 / 1M
कॅश लिहिण्याची किंमत
$0.000 / 1M
कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.
चुकीच्या चाचण्या: 9
प्रति प्रयत्न पास दर: 13.0%
बेंचमार्क कव्हरेज: 36/69 प्रयत्न. अडॅप्टर पर्याय देतात. 12/23 चाचण्या समर्थित आहेत. इतर चाचण्या असमर्थित आहेत, अयशस्वी नाहीत. गुण संपूर्ण चाचणी संचावर आधारित आहेत.
अस्थिर चाचण्या
0
अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).
चार्ट्स
पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.
स्कोअर vs एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
झटपट तुलना
श्रेणीवार तपशील
| श्रेणी | स्कोअर | सुसंगतता | बरोबर चाचण्या |
|---|---|---|---|
| स्वायत्त एजंट कार्ये | 0.0 | 0.0 | |
| अँटी-एआय युक्त्या | 2.3 | 7.5 | |
| कोडिंग | 2.5 | 6.7 | |
| संयुक्त | 0.0 | 0.0 | |
| डेटा पार्सिंग आणि निष्कर्षण | 10.0 | 10.0 | |
| डोमेन-विशिष्ट | 5.3 | 10.0 | |
| Samanya Buddhimatta | 0.0 | 0.0 | |
| सूचनांचे पालन | 1.5 | 5.0 | |
| कोडी सोडवणे | 1.7 | 3.3 | |
| टूल कॉलिंग | 0.0 | 0.0 | |
| सामान्य ज्ञान | 0.0 | 0.0 |