नेविगेशन
AI BENCHY
Advertise here

Grok 4.5 (low) vs Grok 4.6 (medium)

Grok 4.5 (low) average score में आगे है: 8.4 vs 8.3. Grok 4.5 (low) की benchmark लागत कम है: $0.935 vs $1.656. Grok 4.5 (low) तेज है: 15.56s vs 71.86s, pass rates 75.8% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#35
कुल आउटपुट टोकन
113,951
प्रतिक्रिया समय (औसत)
15.56s
कुल लागत
$0.935
रैंक
#40
कुल आउटपुट टोकन
240,338
प्रतिक्रिया समय (औसत)
71.86s
कुल लागत
$1.656
अनुशंसित मॉडल Grok 4.5 (low)

It has the best score here (8.4), while costing about 1.8x less than Grok 4.6 (medium).

विस्तृत तुलना

मेट्रिक Grok 4.5 Grok 4.5 low रिलीज़: 2026-07-08 Grok 4.6 Grok 4.6 medium रिलीज़: 2026-08-12
स्कोर 8.4 8.3
रैंक #35 #40
विश्वसनीयता 10.0 10.0
संगति 9.7 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 75.8% 80.3%
अस्थिर टेस्ट 1 5
कुल रन 66 66
प्रति परिणाम लागत 5.844 11.038
कुल लागत $0.935 $1.656
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $6.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 125,596 106,778
आउटपुट टोकन 7,505 4,811
रीजनिंग टोकन 106,446 235,527
प्रतिक्रिया समय (औसत) 15.56s 71.86s
प्रतिक्रिया समय (अधिकतम) 205.28s 514.35s
प्रतिक्रिया समय (कुल) 342.32s 1580.96s
पैरामीटर ~1.7T कुल (~170B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#35 xAI: Grok 4.5

low
लागत
$0.011
समय
12.4s
टोकन
2,018 tok

#40 SpaceXAI: Grok 4.6

medium
लागत
$0.028
समय
72.1s
टोकन
4,771 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

त्वरित तुलना

तुलना जोड़ी बदलें