नेविगेशन
AI BENCHY
Advertise here

Grok 4.5 (medium) vs Grok 4.6 (medium)

average score लगभग बराबर है: 8.3 vs 8.3. Grok 4.6 (medium) की benchmark लागत कम है: $1.656 vs $1.928. Grok 4.5 (medium) तेज है: 61.71s vs 71.86s, pass rates 78.8% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#39
कुल आउटपुट टोकन
280,567
प्रतिक्रिया समय (औसत)
61.71s
कुल लागत
$1.928
रैंक
#40
कुल आउटपुट टोकन
240,338
प्रतिक्रिया समय (औसत)
71.86s
कुल लागत
$1.656
अनुशंसित मॉडल Grok 4.6 (medium)

It has the strongest score in this comparison (8.3) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08 Grok 4.6 Grok 4.6 medium रिलीज़: 2026-08-12
स्कोर 8.3 8.3
रैंक #39 #40
विश्वसनीयता 10.0 10.0
संगति 8.9 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 78.8% 80.3%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 12.049 11.038
कुल लागत $1.928 $1.656
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $6.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 122,146 106,778
आउटपुट टोकन 5,514 4,811
रीजनिंग टोकन 275,053 235,527
प्रतिक्रिया समय (औसत) 61.71s 71.86s
प्रतिक्रिया समय (अधिकतम) 436.38s 514.35s
प्रतिक्रिया समय (कुल) 1357.56s 1580.96s
पैरामीटर ~1.7T कुल (~170B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#39 xAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

#40 SpaceXAI: Grok 4.6

medium
लागत
$0.028
समय
72.1s
टोकन
4,771 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

त्वरित तुलना

तुलना जोड़ी बदलें