- क्रमांक
- #37
- एकूण आउटपुट टोकन्स
- 299,460
- प्रतिसाद वेळ (सरासरी)
- 68.59s
- एकूण खर्च
- $2.042
Grok 4.5 (medium) vs GLM 5.2 (medium)
Grok 4.5 (medium) average score मध्ये पुढे आहे: 8.5 vs 7.8. GLM 5.2 (medium) चा benchmark खर्च कमी आहे: $0.224 vs $2.042. GLM 5.2 (medium) वेगवान आहे: 23.28s vs 68.59s, pass rates 83.3% vs 80.3%.
- क्रमांक
- #65
- एकूण आउटपुट टोकन्स
- 61,761
- प्रतिसाद वेळ (सरासरी)
- 23.28s
- एकूण खर्च
- $0.224
शिफारस केलेले मॉडेल
GLM 5.2 (medium)
Its score stays close to the best score here (7.8 vs 8.5), while costing about 9.1x less than Grok 4.5 (medium).
तपशीलवार तुलना
| मेट्रिक | Grok 4.5 Grok 4.5 medium | GLM 5.2 GLM 5.2 medium |
|---|---|---|
| स्कोअर | 8.5 | 7.8 |
| क्रमांक | #37 | #65 |
| विश्वसनीयता | 10.0 | 9.5 |
| सुसंगतता | 8.9 | 8.0 |
| प्रयत्न | 66/66 | 63/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 83.3% | 80.3% |
| अस्थिर चाचण्या | 3 | 4 |
| एकूण रन | 66 | 63 |
| प्रति निकाल खर्च | 12.007 | 2.159 |
| एकूण खर्च | $2.042 | $0.224 |
| इनपुट किंमत | $2.000 / 1M | $0.966 / 1M |
| आउटपुट किंमत | $6.000 / 1M | $3.036 / 1M |
| एकूण इनपुट टोकन्स | 122,155 | 37,199 |
| आउटपुट टोकन्स | 5,514 | 12,261 |
| रिझनिंग टोकन्स | 293,946 | 49,500 |
| प्रतिसाद वेळ (सरासरी) | 68.59s | 23.28s |
| प्रतिसाद वेळ (कमाल) | 436.38s | 101.36s |
| प्रतिसाद वेळ (एकूण) | 1508.91s | 488.94s |
| पॅरामीटर्स | ~1.7T एकूण (~170B सक्रिय) | 744B एकूण (40B सक्रिय) |
| उपलब्धता | बंद स्रोत | मुक्त स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#37 SpaceXAI: Grok 4.5
medium- खर्च
- $0.044
- वेळ
- 59.4s
- टोकन्स
- 7,512 tok
#65 GLM 5.2
medium- खर्च
- $0.041
- वेळ
- 195.8s
- टोकन्स
- 9,287 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
Muse Spark 1.2lowvsGrok 4.5mediumQwen3.8 27BlowvsGLM 5.2mediumGPT-5.2 ChatnonevsGLM 5.2mediumQwen3.8 27BhighvsGrok 4.5mediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumQwen3.7 FlashhighvsGLM 5.2mediumQwen3.8 MaxlowvsGrok 4.5mediumInkling SmallhighvsGrok 4.5mediumGPT-5.6 TerrahighvsGLM 5.2mediumSeed-2.0-CodelowvsGLM 5.2mediumMuse Spark 1.1lowvsGrok 4.5medium