- रैंक
- #139
- कुल आउटपुट टोकन
- 225,904
- प्रतिक्रिया समय (औसत)
- 44.21s
- कुल लागत
- $0.741
Grok 4.3 (medium) vs GLM 5.1 (medium)
average score लगभग बराबर है: 7.0 vs 7.0. GLM 5.1 (medium) की benchmark लागत कम है: $0.727 vs $0.741. Grok 4.3 (medium) तेज है: 44.21s vs 58.80s, pass rates 66.7% vs 65.2%.
तुलना किए गए मॉडल
- रैंक
- #142
- कुल आउटपुट टोकन
- 215,889
- प्रतिक्रिया समय (औसत)
- 58.80s
- कुल लागत
- $0.727
अनुशंसित मॉडल
Grok 4.3 (medium)
It has the strongest score in this comparison (7.0) and the best overall balance of cost and response time across all 2 models.
विस्तृत तुलना
| मेट्रिक | Grok 4.3 Grok 4.3 medium | GLM 5.1 GLM 5.1 medium |
|---|---|---|
| स्कोर | 7.0 | 7.0 |
| रैंक | #139 | #142 |
| विश्वसनीयता | 10.0 | 8.1 |
| संगति | 8.2 | 8.4 |
| प्रयास | 66/66 | 66/66 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 66.7% | 65.2% |
| अस्थिर टेस्ट | 5 | 4 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 6.168 | 6.923 |
| कुल लागत | $0.741 | $0.727 |
| इनपुट कीमत | $1.250 / 1M | $0.966 / 1M |
| आउटपुट कीमत | $2.500 / 1M | $3.036 / 1M |
| कुल इनपुट टोकन | 140,244 | 82,592 |
| आउटपुट टोकन | 13,739 | 16,089 |
| रीजनिंग टोकन | 212,165 | 199,800 |
| प्रतिक्रिया समय (औसत) | 44.21s | 58.80s |
| प्रतिक्रिया समय (अधिकतम) | 216.69s | 308.75s |
| प्रतिक्रिया समय (कुल) | 972.64s | 1234.72s |
| पैरामीटर | ~1.5T कुल (~150B सक्रिय) | 744B कुल (40B सक्रिय) |
| उपलब्धता | बंद स्रोत | मुक्त स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#139 SpaceXAI: Grok 4.3
medium- लागत
- $0.009
- समय
- 19.0s
- टोकन
- 3,661 tok
#142 GLM 5.1
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- लागत
- $0.000
- समय
- 300.0s
- टोकन
- 0 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
GPT-5.5nonevsGLM 5.1mediumGPT-5.6 SolnonevsGrok 4.3mediumMercury 2.5highvsGrok 4.3mediumGPT-5.6 SolnonevsGLM 5.1mediumGPT-5.5nonevsGrok 4.3mediumSolar Pro 4highvsGrok 4.3mediumClaude Fable 5.1lowvsGLM 5.1mediumMercury 2.5highvsGLM 5.1mediumSeed-2.0-CodehighvsGLM 5.1mediumStep 3.7 FlashlowvsGrok 4.3mediumMuse Glimmer 30BlowvsGrok 4.3mediumSolar Pro 4highvsGLM 5.1medium