सारांश
Grok Build 0.1 AI BENCHY पर 6.6 स्कोर करता है और #82 पर है। इसकी reliability 10.0, pass rate 60.4%, कुल लागत $0.547, और औसत response time 28.69s है।
संग्रहीत मॉडल: इस मॉडल को अब अपडेट नहीं किया जाएगा और नए परीक्षणों में टेस्ट नहीं किया जाएगा।
मॉडल विवरण
शोध की तारीख: 2026-08-12
- पैरामीटर
- ~300B कुल (~30B सक्रिय)
- आर्किटेक्चर
- MoE
- उपलब्धता
- बंद स्रोत
- लाइसेंस
- -
सार्वजनिक साक्ष्यों पर आधारित सर्वोत्तम अनुमान; प्रदाता ने सभी मान जारी नहीं किए हैं।
6.6
संगति
8.0
10.0
$0.547
कुल आउटपुट टोकन
267,275
कुल इनपुट टोकन
0
इनपुट कीमत
$1.000 / 1M
आउटपुट कीमत
$2.000 / 1M
कैश पढ़ने की कीमत
लागू नहीं
कैश लिखने की कीमत
लागू नहीं
कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।
अस्थिर टेस्ट
4
अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।
रन इतिहास
| परीक्षण किया गया | स्कोर | विश्वसनीयता | सही परीक्षण | कुल लागत | तुलना करें |
|---|---|---|---|---|---|
| 2026-05-21 12:40 दोबारा परीक्षण | 4.0 | 10.0 | $0.547 | तुलना करें | |
| 2026-05-21 12:40 दोबारा परीक्षण | 4.0 | 10.0 | $0.547 | तुलना करें | |
| 2026-05-21 12:40 दोबारा परीक्षण | 6.0 | 10.0 | $0.547 | तुलना करें | |
| 2026-05-21 12:40 दोबारा परीक्षण | 6.6 | 10.0 | $0.547 | वर्तमान रन |
चार्ट
पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।
स्कोर vs कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
| श्रेणी | स्कोर | संगति | सही परीक्षण |
|---|---|---|---|
| एंटी-एआई ट्रिक्स | 8.7 | 7.9 | |
| कोडिंग | 10.0 | 10.0 | |
| संयुक्त | 0.0 | 0.0 | |
| डेटा पार्सिंग और निष्कर्षण | 4.7 | 1.6 | |
| डोमेन-विशिष्ट | 3.6 | 7.2 | |
| Samanya Buddhimatta | 4.3 | 10.0 | |
| निर्देश पालन | 9.8 | 10.0 | |
| पहेली समाधान | 6.4 | 7.7 | |
| टूल कॉलिंग | 0.0 | 0.0 | |
| सामान्य ज्ञान | 3.0 | 10.0 |