- क्रमांक
- #139
- एकूण आउटपुट टोकन्स
- 225,904
- प्रतिसाद वेळ (सरासरी)
- 44.21s
- एकूण खर्च
- $0.741
Grok 4.3 (medium) vs GLM 5.1 (medium)
average score जवळपास समान आहे: 7.0 vs 7.0. GLM 5.1 (medium) चा benchmark खर्च कमी आहे: $0.727 vs $0.741. Grok 4.3 (medium) वेगवान आहे: 44.21s vs 58.80s, pass rates 66.7% vs 65.2%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #142
- एकूण आउटपुट टोकन्स
- 215,889
- प्रतिसाद वेळ (सरासरी)
- 58.80s
- एकूण खर्च
- $0.727
शिफारस केलेले मॉडेल
Grok 4.3 (medium)
It has the strongest score in this comparison (7.0) and the best overall balance of cost and response time across all 2 models.
तपशीलवार तुलना
| मेट्रिक | Grok 4.3 Grok 4.3 medium | GLM 5.1 GLM 5.1 medium |
|---|---|---|
| स्कोअर | 7.0 | 7.0 |
| क्रमांक | #139 | #142 |
| विश्वसनीयता | 10.0 | 8.1 |
| सुसंगतता | 8.2 | 8.4 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 66.7% | 65.2% |
| अस्थिर चाचण्या | 5 | 4 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 6.168 | 6.923 |
| एकूण खर्च | $0.741 | $0.727 |
| इनपुट किंमत | $1.250 / 1M | $0.966 / 1M |
| आउटपुट किंमत | $2.500 / 1M | $3.036 / 1M |
| एकूण इनपुट टोकन्स | 140,244 | 82,592 |
| आउटपुट टोकन्स | 13,739 | 16,089 |
| रिझनिंग टोकन्स | 212,165 | 199,800 |
| प्रतिसाद वेळ (सरासरी) | 44.21s | 58.80s |
| प्रतिसाद वेळ (कमाल) | 216.69s | 308.75s |
| प्रतिसाद वेळ (एकूण) | 972.64s | 1234.72s |
| पॅरामीटर्स | ~1.5T एकूण (~150B सक्रिय) | 744B एकूण (40B सक्रिय) |
| उपलब्धता | बंद स्रोत | मुक्त स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#139 SpaceXAI: Grok 4.3
medium- खर्च
- $0.009
- वेळ
- 19.0s
- टोकन्स
- 3,661 tok
#142 GLM 5.1
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- खर्च
- $0.000
- वेळ
- 300.0s
- टोकन्स
- 0 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
GPT-5.5nonevsGLM 5.1mediumGPT-5.6 SolnonevsGrok 4.3mediumMercury 2.5highvsGrok 4.3mediumGPT-5.6 SolnonevsGLM 5.1mediumGPT-5.5nonevsGrok 4.3mediumSolar Pro 4highvsGrok 4.3mediumClaude Fable 5.1lowvsGLM 5.1mediumMercury 2.5highvsGLM 5.1mediumSeed-2.0-CodehighvsGLM 5.1mediumStep 3.7 FlashlowvsGrok 4.3mediumMuse Glimmer 30BlowvsGrok 4.3mediumSolar Pro 4highvsGLM 5.1medium