सारांश
GPT-6 Luna Decisions AI BENCHY पर 2.4 स्कोर करता है और #390 पर है। इसकी reliability 10.0, pass rate 13.0%, कुल लागत $0.005, और औसत response time 495ms है।
GPT-6 Luna Decisions को अलग क्या बनाता है: यह समान मॉडलों की तुलना में काफ़ी तेज है।
मॉडल विवरण
शोध की तारीख: 2026-10-07
- पैरामीटर
- ~400B कुल (~17B सक्रिय)
- आर्किटेक्चर
- MoE
- उपलब्धता
- बंद स्रोत
- लाइसेंस
- -
सार्वजनिक साक्ष्यों पर आधारित सर्वोत्तम अनुमान; प्रदाता ने सभी मान जारी नहीं किए हैं।
2.4
संगति
5.2
10.0
$0.005
कुल आउटपुट टोकन
0
कुल इनपुट टोकन
47,583
इनपुट कीमत
$0.100 / 1M
आउटपुट कीमत
$0.000 / 1M
कैश पढ़ने की कीमत
$0.000 / 1M
कैश लिखने की कीमत
$0.000 / 1M
कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।
गलत टेस्ट: 9
प्रति प्रयास पास दर: 13.0%
बेंचमार्क कवरेज: 36/69 प्रयास. विकल्प अडैप्टर देते हैं। 12/23 परीक्षण समर्थित हैं। अन्य परीक्षण असमर्थित हैं, विफल नहीं। स्कोर पूरे परीक्षण समूह पर आधारित है।
अस्थिर टेस्ट
0
अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।
चार्ट
पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।
स्कोर vs कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
त्वरित तुलना
श्रेणी विवरण
| श्रेणी | स्कोर | संगति | सही परीक्षण |
|---|---|---|---|
| स्वायत्त एजेंट कार्य | 0.0 | 0.0 | |
| एंटी-एआई ट्रिक्स | 2.3 | 7.5 | |
| कोडिंग | 2.5 | 6.7 | |
| संयुक्त | 0.0 | 0.0 | |
| डेटा पार्सिंग और निष्कर्षण | 10.0 | 10.0 | |
| डोमेन-विशिष्ट | 5.3 | 10.0 | |
| Samanya Buddhimatta | 0.0 | 0.0 | |
| निर्देश पालन | 1.5 | 5.0 | |
| पहेली समाधान | 1.7 | 3.3 | |
| टूल कॉलिंग | 0.0 | 0.0 | |
| सामान्य ज्ञान | 0.0 | 0.0 |