Advertise here
#62

Grok 4.6

X AI रिलीज़: 2026-08-12 परीक्षण किया गया: 2026-08-14 04:35 x-ai/grok-4.6::medium
~1.7T कुल (~170B सक्रिय)MoEबंद स्रोतअनुमानित
(high) (medium) (low)

सारांश

Grok 4.6 AI BENCHY पर 8.4 स्कोर करता है और #62 पर है। इसकी reliability 10.0, pass rate 81.8%, कुल लागत $1.713, और औसत response time 73.46s है।

मॉडल विवरण

शोध की तारीख: 2026-08-12

अनुमानित
पैरामीटर
~1.7T कुल (~170B सक्रिय)
आर्किटेक्चर
MoE
उपलब्धता
बंद स्रोत
लाइसेंस
-

सार्वजनिक साक्ष्यों पर आधारित सर्वोत्तम अनुमान; प्रदाता ने सभी मान जारी नहीं किए हैं।

संगति

8.6

कुल आउटपुट टोकन

249,808

कुल इनपुट टोकन

106,787

इनपुट कीमत

$2.000 / 1M

आउटपुट कीमत

$6.000 / 1M

सही परीक्षण

गलत टेस्ट: 6

प्रति प्रयास पास दर: 81.8%

अस्थिर टेस्ट

4

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

73.46s

प्रतिक्रिया समय (अधिकतम): 514.35s

प्रतिक्रिया समय (कुल): 1616.12s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 SpaceXAI: Grok 4.6

medium
लागत
$0.028
समय
72.1s
टोकन
4,771 tok

रन इतिहास

परीक्षण किया गया स्कोर विश्वसनीयता सही परीक्षण कुल लागत तुलना करें
2026-08-14 04:35 दोबारा परीक्षण 8.4 10.0 $1.713 वर्तमान रन
2026-08-12 22:58 पहला रन 8.3 10.0 $1.656 तुलना करें

इस रन में अलग बेंचमार्क सूट इस्तेमाल हुआ था। ऐतिहासिक बदलाव पढ़ते समय सूट बदलाव को ध्यान में रखें।

कीमत का इतिहास

OpenRouter से इस मॉडल का ऐतिहासिक मूल्य डेटा।

तारीख इनपुट कीमत आउटपुट कीमत
2026-08-14 12:51 $2.000 / 1M $6.000 / 1M

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

त्वरित तुलना

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
एंटी-एआई ट्रिक्स 10.0 10.0
कोडिंग 8.2 7.2
संयुक्त 10.0 10.0
डेटा पार्सिंग और निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 5.3 7.2
Samanya Buddhimatta 4.1 2.7
निर्देश पालन 9.8 10.0
पहेली समाधान 8.7 7.7
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना किए गए मॉडल