- रैंक
- #175
- कुल आउटपुट टोकन
- 270,259
- प्रतिक्रिया समय (औसत)
- 32.56s
- कुल लागत
- $0.805
Grok 4.20 (medium) vs Grok 4.3 (medium)
average score लगभग बराबर है: 7.0 vs 7.0. Grok 4.3 (medium) की benchmark लागत कम है: $0.741 vs $0.805. Grok 4.20 (medium) तेज है: 32.56s vs 44.21s, pass rates 60.6% vs 66.7%.
तुलना किए गए मॉडल
- रैंक
- #167
- कुल आउटपुट टोकन
- 225,904
- प्रतिक्रिया समय (औसत)
- 44.21s
- कुल लागत
- $0.741
अनुशंसित मॉडल
Grok 4.20 (medium)
It has the strongest score in this comparison (7.0) and the best overall balance of cost and response time across all 2 models.
विस्तृत तुलना
| मेट्रिक | Grok 4.20 Grok 4.20 medium | Grok 4.3 Grok 4.3 medium |
|---|---|---|
| स्कोर | 7.0 | 7.0 |
| रैंक | #175 | #167 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 8.2 | 8.2 |
| प्रयास | 66/66 | 66/66 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 60.6% | 66.7% |
| अस्थिर टेस्ट | 5 | 5 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 10.365 | 6.168 |
| कुल लागत | $0.805 | $0.741 |
| इनपुट कीमत | $1.250 / 1M | $1.250 / 1M |
| आउटपुट कीमत | $2.500 / 1M | $2.500 / 1M |
| कुल इनपुट टोकन | 102,986 | 140,244 |
| आउटपुट टोकन | 5,860 | 13,739 |
| रीजनिंग टोकन | 264,399 | 212,165 |
| प्रतिक्रिया समय (औसत) | 32.56s | 44.21s |
| प्रतिक्रिया समय (अधिकतम) | 199.66s | 216.69s |
| प्रतिक्रिया समय (कुल) | 716.36s | 972.64s |
| पैरामीटर | ~1T कुल (~100B सक्रिय) | ~1.5T कुल (~150B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#175 SpaceXAI: Grok 4.20
medium- लागत
- $0.041
- समय
- 110.3s
- टोकन
- 16,336 tok
#167 SpaceXAI: Grok 4.3
medium- लागत
- $0.009
- समय
- 19.0s
- टोकन
- 3,661 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
GPT-5.6 SolnonevsGrok 4.3mediumGPT-6 LunalowvsGrok 4.3mediumGPT-5.5nonevsGrok 4.20mediumEmber-1highvsGrok 4.3mediumSpace Bunny AlphahighvsGrok 4.20mediumSpace Bunny AlphahighvsGrok 4.3mediumMercury 2.5highvsGrok 4.3mediumGPT-5.5nonevsGrok 4.3mediumGPT-6 LunalowvsGrok 4.20mediumGPT-5.6 SolnonevsGrok 4.20mediumSolar Pro 4highvsGrok 4.3mediumClaude Fable 5.1lowvsGrok 4.20medium